---
title: "Eigene Modelle · auf deine Arbeitsweise trainiert | StudioMeyer"
description: "Ein offenes Basismodell auf dein Wissen weitertrainiert. Vier Wege hinein: Wissen, Abläufe, Verhalten, Roboter-Anbindung. Der Datensatz gehört dir und überlebt jeden Modellwechsel."
canonical: "https://studiomeyer.io/de/services/eigene-modelle"
language: de
last_updated: 2026-08-09
image: "https://studiomeyer.io/de/services/eigene-modelle/opengraph-image?d539e75ab13d68c1"
markdown_versions: ["https://studiomeyer.io/de/services/eigene-modelle.md", "https://studiomeyer.io/en/services/eigene-modelle.md", "https://studiomeyer.io/es/services/eigene-modelle.md"]
publisher: "StudioMeyer, https://studiomeyer.io (llms.txt: https://studiomeyer.io/llms.txt)"
---

Eigene Modelle

# Ein Modell, das deine Arbeitsweise gelernt hat.

Ein guter Prompt erklärt einem fremden Modell jedes Mal neu, wie bei dir gearbeitet wird. Ein eigenes Modell hat es gelernt. Wir trainieren ein offenes Basismodell auf dein Wissen weiter, der Datensatz gehört dir und überlebt jeden Modellwechsel.

[Die vier Wege ansehen](#angebote)[Wie wir vorgehen](#process)

Der Unterschied

## Erklären, nachschlagen, oder wissen.

Es gibt drei Stellen, an denen eine Regel landen kann. Anweisung und Gedächtnis nimmst du überall mit. Das Gelernte gehört dagegen zu genau dem Modell, auf dem es gelernt wurde. Was einen Modellwechsel wirklich unbeschadet übersteht, ist der Datensatz dahinter.

In der Anweisung

gilt für dieses eine Gespräch

Fest im Modell

gilt, ohne dass es jemand hinschreibt

Im Gedächtnis

gilt, wenn danach gesucht wird

### Der Datensatz ist das Vermögen, nicht das Modell

Ein trainiertes Modell veraltet, wie jedes Modell. Der Datensatz dahinter ist wiederverwendbar: Kommt in einem Jahr ein besseres Basismodell, trainieren wir daraus neu. Gepflegt werden muss er trotzdem. Produkte ändern sich, Ton ändert sich, alte Beispiele bilden irgendwann Verhalten ab, das keiner mehr will. Deshalb gehört er dir, schriftlich, samt Versionsstand.

### Deine Daten gehen nie in ein gemeinsames Modell

Jeder Kunde bekommt seinen eigenen Trainingslauf und sein eigenes Ergebnis. Es gibt kein StudioMeyer-Modell, das aus den Daten aller Kunden zusammengelernt hat. Das ist keine Einstellung, so ist es gebaut.

### Kein Anbieter-Zwang

Das Basismodell ist offen lizenziert, das Ergebnis läuft auf deiner Hardware oder in deiner Cloud. Du brauchst uns danach nicht, um es zu betreiben. Du brauchst uns, wenn du es weiterentwickeln willst.

Einordnung

## Meistens brauchst du kein Training.

Training ist für die Form, nicht für die Fakten. Es gibt vier Stufen, und jede kommt erst dran, wenn die davor gemessen versagt hat, nicht gefühlt.

1. 1

    ### Anweisung

    Die Regel steht im Text, den das Modell bei jeder Anfrage mitbekommt. Kostet nichts, ist sofort änderbar, gilt aber nur für dieses eine Gespräch.

2. 2

    ### Gedächtnis

    Wissen, das sich ändert, gehört hierher: Preise, Bestände, Kundenhistorie. Nachschlagen statt einlernen.

3. 3

    ### Training

    Erst wenn Form, Fachvokabular oder Werkzeug-Aufrufe wiederholbar danebenliegen. Dann lernt das Modell das Verhalten fest ein.

4. 4

    ### Verkleinern

    Ein großes Modell bringt einem kleinen bei, wie es antwortet. Für den Fall, dass es klein, schnell und billig laufen muss.

Wir prüfen zuerst, ob ein guter Prompt und ein Gedächtnis reichen. In den meisten Fällen tun sie das, und dann sagen wir das auch, statt einen Trainingslauf zu verkaufen.

Vier Wege hinein

## Wo eine Regel landet, entscheidet ob sie hält.

Nicht jede Regel gehört ins Modell. Manches ist in der Anweisung richtig aufgehoben, manches im Gedächtnis, manches muss hart abgesichert werden. Wir sortieren das vor dem ersten Trainingslauf.

### Wissen

Was in deinem Betrieb stabil ist: wie die Dinge heißen, welche Fälle es gibt, wie ihr sie unterscheidet, welche Fachbegriffe intern gelten. Heute steht das in einer Anleitung neben dem Modell und wird bei jeder Anfrage mitgeschickt.

Nach dem Training weiß es das Modell. Das macht Antworten kürzer, schneller und weniger abhängig davon, ob die richtige Textstelle gefunden wurde. Was sich ändert, Preise, Bestände, Termine, Kundendaten, bleibt bewusst draußen und wird zur Laufzeit nachgeschlagen.

### Abläufe

Wie bei dir gearbeitet wird: In welcher Reihenfolge, mit welchen Zwischenschritten, wann jemand gegenlesen muss. Als Regelwerk aufgeschrieben wird das schnell länger als es hilft.

Als gelernte Reihenfolge braucht es keine Aufzählung mehr. Das Modell macht es so, wie es in deinen Beispielen gemacht wurde.

### Verhalten

Wie geantwortet wird: Ton, Länge, Grenzen. Was nie zugesagt werden darf. Wann nicht geraten, sondern nachgefragt wird. Genau das, was in einer Anleitung am schnellsten ignoriert wird.

Verhalten trainieren heißt Beispiele bevorzugen und ablehnen, nicht Regeln schreiben. Was hart bleiben muss, sichern wir zusätzlich außerhalb des Modells ab.

### Roboter-Anbindung

Ein Roboter ist aus Sicht des Systems ein weiterer Client, der Werkzeuge aufruft, wie ein Chat-Fenster, nur mit Armen. Die Schnittstelle dafür ist dieselbe, die wir schon für Verbinder und Systeme bauen.

Der Roboter geht irgendwann, das gelernte Wissen über deinen Betrieb bleibt. Deshalb bauen wir es nicht in den Roboter, sondern daneben.

Ehrlich

## Was ein Training löst, und was nicht.

### Das löst es

- Exaktes Ausgabeschema

    Dasselbe Formular, dieselbe JSON-Struktur, zehntausendmal. Das Training bringt die Trefferquote hoch, garantiert wird sie durch ein erzwungenes Schema und eine Prüfung danach: Was nicht passt, wird abgefangen und nicht ausgeliefert.

- Enges Fachvokabular

    Branchensprache, interne Kürzel, Normen, ohne dass jemand sie bei jedem Aufruf neu erklärt.

- Markenstimme

    Konsistent, ohne dreiseitigen Prompt vor jeder Antwort.

- Verlässliche Werkzeug-Aufrufe bei kleinen Modellen

    Praktisch der wichtigste Punkt. Erst versuchen wir es mit weniger Werkzeugen, besseren Beschreibungen und Beispielen, reicht das nicht, stabilisiert ein Training Auswahl und Parameter deutlich.

### Das löst es nicht

- Frisches oder wechselndes Wissen

    Preise, Bestände, Termine gehören ins Gedächtnis, nicht ins Modell. Was sich ändert, wird nachgeschlagen.

- Aus klein wird nicht klug

    Ein kleines Modell wird enger und verlässlicher, nicht klüger. Wer behauptet, ein Training mache aus einem kleinen Modell ein Spitzenmodell, verkauft etwas Falsches.

- Lernen hat Nebenwirkungen

    Ein Modell vergisst an anderer Stelle, wenn es Neues lernt. Dagegen arbeitet man mit Datenmischung, aber man muss es wissen.

- Ohne getrennte Prüfbeispiele weiß niemand etwas

    Ohne Beispiele, die vorher beiseitegelegt wurden, lässt sich nicht sagen, ob ein Lauf etwas verbessert oder kaputtgemacht hat. Daran scheitern die meisten Projekte.

Womit

## Womit wir das bauen.

Offene Modelle, nachvollziehbare Verfahren, nichts Geheimes. Diese Liste ist für alle, die es genau wissen wollen. Verstehen musst du sie nicht, wer den Stack kennt, kann damit jede Zahl nachprüfen.

Basismodell

Ein offen lizenziertes Modell, dessen Lizenz die geplante Nutzung erlaubt, häufig Apache 2.0, manchmal eine eigene Herstellerlizenz mit Auflagen. Welches es wird, steht mit Name, Version und Lizenz im Angebot. Die Wahl richtet sich nach Aufgabe und Hardware, nicht nach Mode.

QLoRA + SFT

Unser Standardfall. Nach unserer bisherigen technischen Einschätzung trägt er die allermeisten Vorhaben: Ausgabeformat, Fachvokabular, Stimme und Tool-Calls. Trainiert wird ein Adapter, nicht das ganze Modell. Das hält Läufe bezahlbar und erlaubt mehrere Spezialisierungen auf einer Basis.

DPO / SimPO

Stufe zwei, sobald das überwachte Training sitzt. Nachgeschärft wird an Paaren nach dem Muster: A ist besser als B. Verhalten entsteht schon in der ersten Stufe aus den Beispielen, hier wird es zwischen besser und schlechter geschärft.

GRPO / DAPO

Verstärkendes Lernen mit prüfbarer Belohnung, bei uns für den Orchestrator. Lohnt nur, wenn Richtigkeit maschinell messbar ist. Bei Tool-Calls ist sie genau das.

Eigene Hardware oder Miet-GPU

Der Lauf passiert, wo die Daten liegen dürfen. Für sensible Datensätze lokal, sonst auf gemieteten GPUs. Danach gibt es ein kurzes Löschprotokoll: Instanz beendet, Volumes gelöscht, keine Snapshots angelegt, lokale Kopien entfernt, dazu die Aufbewahrungsfristen des Anbieters.

Auswertung

Vor dem Ausliefern gegen einen Testsatz aus deinem Alltag geprüft, nicht gegen einen Papier-Benchmark. Kein Ergebnis ohne Vergleichsmessung gegen das untrainierte Modell.

Ablauf

## Acht Schritte.

1. 01

    ### Ziel festlegen, Prüfbeispiele zuerst

    Vor der ersten Zeile Trainingsdaten steht die Frage: Woran erkennen wir, dass es funktioniert hat? Ein Satz Beispiele wird beiseitegelegt und im Training nie angefasst.

2. 02

    ### Prüfen, ob es ohne Training geht

    Anweisung und Gedächtnis werden gegen dieselben Beispiele gemessen. Reicht das, ist das Projekt hier zu Ende, zu deinen Gunsten.

3. 03

    ### Datensatz aufbauen

    Der ehrlichste Punkt der Seite: In der Projektplanung rechnen wir damit, dass ein Drittel bis die Hälfte des Aufwands reine Datenaufbereitung ist, ein Erfahrungswert aus der Fachliteratur und unseren eigenen Läufen, keine Messung über eine Kundenbasis. Beispiele kommen aus dem echten Betrieb, bekommen Herkunft und Datum und werden versioniert wie Quellcode.

4. 04

    ### Verfahren und Basismodell wählen

    Das Basismodell selbst bleibt unangetastet. Was es dazulernt, landet in einer kleinen eigenen Datei von wenigen hundert Megabyte, die man dem Modell aufsetzt. Es entsteht also kein neues Modell, sondern ein Aufsatz für ein bestehendes.

5. 05

    ### Trainieren auf gemieteter Rechenleistung

    Keine eigene Hardware nötig. Die Karte wird stundenweise gemietet und danach abgeschaltet.

6. 06

    ### Messen gegen die beiseitegelegten Beispiele

    Vorher und nachher, mit Zahlen. Kein Bauchgefühl, kein „fühlt sich besser an".

7. 07

    ### Ausliefern

    Ein Basismodell trägt mehrere Spezialisten gleichzeitig, jeder als eigene kleine Datei. Statt fünf Modellen à 20 GB läuft ein Modell mit fünf Aufsätzen.

8. 08

    ### Pflegen

    Kommt eine neue Modellgeneration, wird aus demselben Datensatz ein neuer Aufsatz trainiert. Genau deshalb ist der Datensatz das Vermögen und nicht das Modell.

FAQ

## Häufige Fragen

Warum nicht einfach einen besseren Prompt schreiben?

Weil eine Anweisung bei jeder Anfrage neu gilt und mit dem Gespräch endet. Für viele Aufgaben reicht das, und dann empfehlen wir genau das. Ein eigenes Modell lohnt sich, wenn dieselbe Erklärung tausendfach mitgeschickt wird, oder wenn eine Regel auch dann halten muss, wenn niemand sie hinschreibt.

Ist das ein eigenes Modell, wenn ihr ein bestehendes weitertrainiert?

Es ist ein eigenes Modell in dem Sinne, dass das Ergebnis dir gehört und aus deinen Daten entstanden ist. Es ist kein von null gebautes Modell, das baut niemand mit vernünftigem Budget, und wer es behauptet, verkauft dir etwas anderes. Die Lizenz des Basismodells erlaubt kommerzielle Weiterentwicklung ausdrücklich.

Gehen unsere Daten in ein Modell, das andere nutzen?

Nein. Jeder Kunde bekommt einen eigenen Lauf und ein eigenes Ergebnis. Ein gemeinsames Modell aus Kundendaten gibt es nicht, nicht als Zusage, sondern weil wir es so nicht bauen.

Was kostet das?

Der Preis richtet sich nach dem Umfang des Datensatzes, nicht nach Rechenzeit. Die Rechenzeit ist der kleinere Posten. Was Zeit kostet, ist das Sortieren und Aufbereiten deines Materials, und das sehen wir erst, wenn wir es angeschaut haben.

Woran sehen wir, dass das funktioniert?

Wir fahren das Verfahren an unserem eigenen Orchestrator, dem System hinter der KI-Station. Was wir bei dir bauen, läuft bei uns im eigenen Betrieb. Und gemessen wird gegen deinen eigenen Testsatz, nicht gegen einen Papier-Benchmark: ohne Vergleich zum untrainierten Modell liefern wir nicht aus.

Und was ist mit n8n und Workflow-Automatisierung?

Bauen wir, wenn ein Ablauf es braucht. Es steht nur nicht als eigenes Produkt im Regal, sondern kommt als Teil des Systems, das wir bei dir bauen. Der Grund ist einfach: Ein einzelner Mail-Waechter bringt wenig, wenn er deinen Betrieb nicht kennt. Genau darum geht es auf dieser Seite.

Nächster Schritt

## Welche Erklärung schickst du jeden Tag mit?

Erzähl uns, was dein Modell jedes Mal neu lernen muss. Wir sagen dir ehrlich, ob das ins Training gehört oder in einen besseren Prompt.

Andere Kategorie · Werkzeuge

### StudioMeyer Memory

Knowledge Graph + Long-Term Memory für deinen KI-Stack. 56 Tools, Multi-Agent, Import von ChatGPT/Claude/Gemini-History. Free, Pro 9 EUR/Mo, Team 19 EUR/Mo.

https://studiomeyer.io/de/services/memory

## Sitemap

Alle Seiten dieser Website als Markdown: [Sitemap](https://studiomeyer.io/sitemap.md). Kuratierter Einstieg: [llms.txt](https://studiomeyer.io/llms.txt).
