Synthetische Daten

Synthetische Daten aus Ihren eigenen Vorlagen.

Sie geben Beispiele und ein Schema vor; das Modell erzeugt daraus Datensätze in großer Zahl. Nützlich überall dort, wo echte Daten zu knapp oder zu heikel sind.

Wofür Teams das einsetzen

Testsätze

Beispiele für die eigene Testsuite, wenn echte Daten knapp oder nicht teilbar sind.

  • Testabdeckung

Randfälle

Genau die Fälle erzeugen, die im echten Bestand zu selten vorkommen, um sie zu testen.

  • Seltene Fälle

Ohne echte Personendaten

Datensätze mit derselben Form, aber ohne echte Personenbezüge.

  • Keine echten Personen

Große Stapel

Bis zu 384K Token Ausgabe pro Aufruf — und in der Nebenzeit zum halben Satz.

  • 384K Ausgabe
  • Nebenzeit

Was das nicht ist

Das erzeugt keine Wahrheit. Synthetische Daten sind so gut wie die Vorlagen und Regeln, die Sie hineingeben — wenn Ihre Beispiele einseitig sind, werden es die erzeugten Daten auch. Wenn Sie synthetische Daten zum Trainieren oder Feintunen eigener Modelle nutzen wollen, sagen Sie es uns offen; das ist ein anderer Anwendungsfall als Testdaten, und wir sagen Ihnen, ob wir dafür der richtige Anbieter sind.

Häufige Fragen

Brauchen wir eigene Beispieldaten?

Ja. Ohne Vorlagen gibt es nichts, woraus erzeugt werden könnte. Je klarer die Beispiele und je genauer die Regeln, desto brauchbarer das Ergebnis.

Können die Daten personenbezogene Bezüge enthalten?

Erzeugte Datensätze können echten Personen ähneln, ohne sie zu sein. Wenn Sie echte Personendaten als Vorlage nutzen wollen, sprechen Sie vorher mit uns — das ist eine Datenschutzfrage, keine technische.

Wie viel lässt sich in einem Lauf erzeugen?

Bis 384K Token Ausgabe pro Aufruf, und beliebig viele Aufrufe. Für größere Mengen lohnt es, in die Nebenzeit zu legen.

Eignet sich das zum Trainieren eigener Modelle?

Das ist ein anderer Anwendungsfall als Testdaten, und wir wollen ihn nicht mitversprechen. Beschreiben Sie uns, was Sie vorhaben, und wir sagen Ihnen, ob wir dafür passen.

Werden unsere Vorlagen zum Training benutzt?

Nein. Wir trainieren keine Modelle mit Ihren Daten. Was behalten wird und wie lange, steht schriftlich im Auftragsverarbeitungsvertrag.

SYNTHETISCHE DATEN

Schema des Ablaufs: drei Stufen, durch Pfeile verbunden; die mittlere Stufe ist hervorgehoben.

Eingabe

Vorlagendokumente und ein Schema

Ihre eigenen Beispiele und Regeln

DeepSeek V4.1 Flash

Ausgabe

Erzeugte Datensätze in großer Zahl

geformt nach Ihrem Schema

  • Erzeugt aus Ihren eigenen Vorlagen
  • Lange Ausgabe für große Stapel
  • Nebenzeiten halbieren den Satz
Aus Ihren eigenen Vorlagen, in großer Zahl erzeugt.Schema des Lastprofils. Kein Screenshot.

Sagen Sie uns, was Sie heute einsetzen.

Schicken Sie uns Ihr Monatsvolumen und Ihren aktuellen Anbieter. Wir antworten in der Regel innerhalb eines Werktags — mit einem Preis und einer festen Ansprechperson.