KI-Modelle
Welche Modelle in Ihrer Instanz laufen - und was sie können
Sie wählen pro Vorgang aus, mit welchem Modell Sie arbeiten. Für jedes weisen wir den Betriebsweg aus und den Stand der Verschwiegenheit nach § 203. Diese Seite erklärt, was die einzelnen Modelle im Kanzlei-Alltag leisten, welche ab dem ersten Tag bereitstehen und welche wir bewusst nicht anbieten.
Für alle 49 Modelle der Vertragskette liegt die § 203-Verpflichtung vor
Jedes Modell der Vertragskette läuft unter einer Verschwiegenheitsverpflichtung nach § 203 Abs. 4 StGB: in Textform, mit Belehrung über die Strafbarkeit, gezeichnet von der Gosign GmbH. Wo eine Plattform an der Verarbeitung mitwirkt, ist deren Verpflichtung zusätzlich gezeichnet und auf ihre Subunternehmer weitergegeben.
Ausgenommen sind die 8 Modelle auf der AWS-Plattform: Für sie klären wir die Grundlage nach § 203 vor der Einrichtung.
Für Sie heißt das: Die Verpflichtungserklärung mit der Gosign GmbH zeichnen Sie einmal, nicht je Modell; die Verpflichtung der Betreiber holen wir ein. Sie ist eine von zwei Voraussetzungen. Ob ein Modell für einen Vorgang mit Mandatsdaten in Frage kommt, hängt zusätzlich vom Betriebsweg ab: davon, ob ein Anbieter Eingaben speichern oder einsehen kann. Welcher Weg für welches Modell gilt, steht in der Tabelle weiter unten.
Vertragspartner für alle Pakete ist die Gosign GmbH (Hallerstraße 8, 20146 Hamburg; Amtsgericht Hamburg, HRB 112197). veryAI ist die Produktmarke der Gosign GmbH.
Sie suchen die berufsrechtliche Einordnung?
Diese Seite beantwortet, was ein Modell kann und ob es Ihnen zur Verfügung steht. Ob ein Modell über einen bestimmten Bezugsweg für Mandatsdaten tragfähig ist, dokumentiert Gosign, das Unternehmen hinter veryAI, mit Quellen und Stand je Kombination.
Auf gosign.de: der 203er-Modellkatalog mit Status je Bezugsweg
Sie brauchen kein Chat-Interface, sondern nur die API?
Dann brauchen Sie diese Instanz nicht. Dieselben Modelle unter derselben Verschwiegenheitsverpflichtung nach § 203 Abs. 4 StGB gibt es als OpenAI-kompatible Schnittstelle direkt von Gosign - Sie binden sie in Ihre eigene Kanzlei- oder Fachsoftware ein und behalten Ihre gewohnte Oberfläche.
veryAI ist der Weg, wenn Sie eine fertige Oberfläche für die Kanzlei wollen - mit Nutzerverwaltung, Mandats-Trennung und Budgets. Beide Wege stehen auf derselben Vertragskette; die Entscheidung ist, ob Sie eine Oberfläche mitkaufen oder nur den Zugang.
Gegenüberstellung
Alle Modelle nebeneinander
Was ein Modell im Betrieb kostet, ist sehr unterschiedlich - zwischen dem günstigsten und dem teuersten liegt Faktor 174. Deshalb gibt es drei Preisklassen statt eines Einheitspreises: Wer viel verarbeitet, arbeitet mit den Modellen, die über die Gosign-Kette in deutschen Rechenzentren laufen, und bekommt dort das Zehnfache an Volumen.
Token zum Einkaufspreis
Wir schlagen auf die Modell-Nutzung nichts auf. Was ein Modell kostet, entscheidet sein Anbieter; wir reichen die Kondition durch und weisen sie je Modell aus - Stand 17.08.2026. Verdient wird an der Betriebspauschale, also an dem, was wir tatsächlich leisten: Vertragskette, eigener Server in Deutschland, Haftung, Betrieb.
Für Sie heißt das zweierlei. Erstens geht Ihr monatliches KI-Budget vollständig in Inferenz - bei Gemini Flash sind das rund 128 Millionen Token im Monat. Zweitens haben wir kein Interesse daran, welches Modell Ihre Leute wählen: Wir verdienen an keinem etwas und empfehlen deshalb das, was zur Aufgabe passt.
11 Modelle stehen unmittelbar nach der Einrichtung bereit. Alle weiteren richten wir auf Anfrage in Ihrer Instanz ein. Für die Modelle der Vertragskette ist dafür kein neuer Vertrag nötig; bei den Modellen auf der AWS-Plattform klären wir die Grundlage nach § 203 vorher. Welches was ist, steht in der Spalte „In Ihrer Instanz“.
Die Tabelle geht seitlich weiter - auf schmalen Geräten wischen Sie waagerecht, um Stärke, Grenze und § 203-Grundlage zu sehen.
| Modell | In Ihrer Instanz | Betrieb | Verarbeitung | Stärke | Grenze | § 203 | Token |
|---|---|---|---|---|---|---|---|
| ChatGPTOpenAI · gpt-5.53,163 € / Mio. Token · Stand 26.07.2026 | ab Tag 1 | EU-Region (Azure-Dienst) | EU (Sweden Central / West Europe); menschliche Missbrauchs-Sichtung nur mit Freigabe je Setup abgeschaltet | Das Modell, das Ihr Team ohnehin kennt - der kürzeste Weg von der privaten Nutzung in die Kanzlei-Umgebung. | Für sehr lange Dokumente greifen Sie besser zu Claude Opus oder Gemini Flash. | Abs.-4-Urkunde der Gosign GmbH; Amendment des Plattform-Anbieters | 3,163 € / Mio. Token |
| Claude OpusAnthropic · claude-opus-59,2 € / Mio. Token · Stand 26.07.2026 | ab Tag 1 | EU-Endpunkt (Google-Plattform) | EU, Zero Retention vertraglich | Die genaueste Stufe für lange Schriftsätze und Verträge - hält auch über viele Seiten den roten Faden. | Langsamer und teurer im Token-Verbrauch als Sonnet; für kurze Routinefragen überdimensioniert. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Plattform-Anbieters, gezeichnet 09/2026 | 9,2 € / Mio. Token |
| Claude SonnetAnthropic · claude-sonnet-53,68 € / Mio. Token · Stand 26.07.2026 | ab Tag 1 | EU-Endpunkt (Google-Plattform) | EU, Zero Retention vertraglich | Die Arbeitsstufe für den Alltag: schnell genug für Zuarbeit, genau genug für Entwürfe. | Bei sehr langen Vertragswerken ist Opus die sichere Wahl. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Plattform-Anbieters, gezeichnet 09/2026 | 3,68 € / Mio. Token |
| Claude HaikuAnthropic · claude-haiku-4.51,84 € / Mio. Token · Stand 26.07.2026 | ab Tag 1 | EU-Endpunkt (Google-Plattform) | EU, Zero Retention vertraglich | Die schnelle Stufe für Kurzaufgaben - Zusammenfassen, Umformulieren, Stichworte ziehen. | Nicht für Aufgaben, bei denen es auf juristische Feinheiten ankommt. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Plattform-Anbieters, gezeichnet 09/2026 | 1,84 € / Mio. Token |
| Gemini FlashGoogle · gemini-3.7-flash0,782 € / Mio. Token · Stand 26.07.2026 | ab Tag 1 | EU-Endpunkt (Google-Plattform) | EU, Zero Retention vertraglich | Verarbeitet sehr große Textmengen am Stück - geeignet für Aktenkonvolute und Massensichtung. | Bei stilistisch anspruchsvollen Entwürfen liegen die Claude-Stufen vorn. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Plattform-Anbieters, gezeichnet 09/2026 | 0,782 € / Mio. Token |
| Mistral 4 119BMistral AI0,3 € / Mio. Token · Stand 17.08.2026 | ab Tag 1 | Deutsche Rechenzentren (Gosign-Kette) | Deutschland, Rechenzentrum nach ISO/IEC 27001, nicht beim Modellhersteller | Starkes europäisches Modell aus deutschen Rechenzentren - gute Wahl, wenn nichts an einen Modellhersteller gehen soll. | Kleineres Kontextfenster als die großen Endpunkt-Modelle. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Betreibers, gezeichnet 09/2026 | 0,3 € / Mio. Token |
| LlamaMeta · llama-4-maverick0,65 € / Mio. Token · Stand 17.08.2026 | auf Anfrage | Deutsche Rechenzentren (Gosign-Kette) | Deutschland, Rechenzentrum nach ISO/IEC 27001, nicht beim Modellhersteller | Bewährtes offenes Modell für Entwürfe und Zusammenfassungen, betrieben über die Gosign-Kette in deutschen Rechenzentren. | Bei komplexer juristischer Argumentation schwächer als die Claude-Stufen. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Betreibers, gezeichnet 09/2026 | 0,65 € / Mio. Token |
| Qwen 3.6 35B A3BQwen (Alibaba Cloud) · qwen3.8-flash0,238 € / Mio. Token · Stand 17.08.2026 | ab Tag 1 | Deutsche Rechenzentren (Gosign-Kette) | Deutschland, Rechenzentrum nach ISO/IEC 27001, nicht beim Modellhersteller | Guter Allrounder aus deutschen Rechenzentren, stark bei strukturierter Extraktion aus Dokumenten. | Deutsche Rechtssprache trifft es weniger sicher als die europäischen Modelle. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Betreibers, gezeichnet 09/2026 | 0,238 € / Mio. Token |
| DeepSeek Flash v4 0731DeepSeek · deepseek-v4-pro-08130,275 € / Mio. Token · Stand 17.08.2026 | ab Tag 1 | Deutsche Rechenzentren (Gosign-Kette) | Deutschland, Rechenzentrum nach ISO/IEC 27001, nicht beim Modellhersteller | Rechnet Aufgaben schrittweise durch - hilfreich bei Fristenketten und mehrstufigen Prüfungen. | Braucht mehr Zeit je Antwort; für schnelle Zuarbeit ungeeignet. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Betreibers, gezeichnet 09/2026 | 0,275 € / Mio. Token |
| GPT-OSS 120BOpenAI · gpt-oss-120b0,25 € / Mio. Token · Stand 17.08.2026 | ab Tag 1 | Deutsche Rechenzentren (Gosign-Kette) | Deutschland, Rechenzentrum nach ISO/IEC 27001, nicht beim Modellhersteller | Offenes Modell aus dem OpenAI-Umfeld - vertraute Arbeitsweise, betrieben über die Gosign-Kette in deutschen Rechenzentren. | Nicht zu verwechseln mit ChatGPT: kleinerer Funktionsumfang. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Betreibers, gezeichnet 09/2026 | 0,25 € / Mio. Token |
| Apertus 70BSwiss AI Initiative1,438 € / Mio. Token · Stand 17.08.2026 | ab Tag 1 | Deutsche Rechenzentren (Gosign-Kette) | Deutschland, Rechenzentrum nach ISO/IEC 27001, nicht beim Modellhersteller | In der Schweiz entwickeltes offenes Modell mit offengelegtem Trainingsweg - für Häuser, die Herkunft belegen wollen. | Kleinere Verbreitung, entsprechend weniger Erfahrungswerte. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Betreibers, gezeichnet 09/2026 | 1,438 € / Mio. Token |
| Gemma 4 26B A4BGoogle · gemma-4-26b-a4b-it0,2 € / Mio. Token · Stand 17.08.2026 | ab Tag 1 | Deutsche Rechenzentren (Gosign-Kette) | Deutschland, Rechenzentrum nach ISO/IEC 27001, nicht beim Modellhersteller | Kompaktes Modell für schnelle Zuarbeit bei geringem Ressourcenbedarf. | Für längere Schriftsätze zu klein. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Betreibers, gezeichnet 09/2026 | 0,2 € / Mio. Token |
| Muse GlimmerMeta · muse-glimmer-30b | auf Anfrage | Deutsche Rechenzentren (Gosign-Kette) | Deutschland, Rechenzentrum nach ISO/IEC 27001, nicht beim Modellhersteller | Kompaktes offenes Modell mit freier Lizenz, vollständig in deutschen Rechenzentren betrieben. | Erst im August 2026 erschienen - für den Kanzlei-Einsatz liegen bisher wenige Erfahrungswerte vor. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Betreibers, gezeichnet 09/2026 | auf Anfrage |
| NemotronNVIDIA · nemotron-3.5-lightning | auf Anfrage | Deutsche Rechenzentren (Gosign-Kette) | Deutschland, Rechenzentrum nach ISO/IEC 27001, nicht beim Modellhersteller | Sehr großes Kontextfenster - umfangreiche Aktenkonvolute müssen nicht in Teile zerlegt werden. | Die größte Stufe braucht mehr Hardware, als eine einzelne Instanz bereitstellt. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Betreibers, gezeichnet 09/2026 | auf Anfrage |
| GLMZ.ai (Zhipu AI) · glm-5.3-flash | auf Anfrage | Deutsche Rechenzentren (Gosign-Kette) | Deutschland, Rechenzentrum nach ISO/IEC 27001, nicht beim Modellhersteller | Höchster Wert im Artificial-Analysis-Index unter den Modellen mit offenen Gewichten, Stand 08/2026. | Auf Programmier- und Agentenaufgaben zugeschnitten - deutsche Rechtssprache ist nicht sein Trainingsschwerpunkt. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Betreibers, gezeichnet 09/2026 | auf Anfrage |
| PhiMicrosoft · phi-4 | auf Anfrage | Deutsche Rechenzentren (Gosign-Kette) | Deutschland, Rechenzentrum nach ISO/IEC 27001, nicht beim Modellhersteller | Klein und sparsam - gebaut für Belegarbeit in Serie. | Für lange Schriftsätze und mehrstufige Argumentation ist die Modellgröße zu klein. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Betreibers, gezeichnet 09/2026 | auf Anfrage |
| WhisperOpenAI | auf Anfrage | Deutsche Rechenzentren (Gosign-Kette) | Deutschland, Rechenzentrum nach ISO/IEC 27001, nicht beim Modellhersteller | Das reifste Modell für Mitschriften, belastbar auch bei Nebengeräuschen und Telefonqualität. | Erkennt Sprecherwechsel nicht von selbst und kann bei Stille Text erfinden - Mitschriften sind gegenzuhören. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Betreibers, gezeichnet 09/2026 | auf Anfrage |
| VoxtralMistral AI · voxtral-small-24b-2507 | auf Anfrage | Deutsche Rechenzentren (Gosign-Kette) | Deutschland, Rechenzentrum nach ISO/IEC 27001, nicht beim Modellhersteller | Schreibt während des Sprechens mit und erreicht im FLEURS-Vergleich 5,9 Prozent Wortfehlerrate. | Deckt 13 Sprachen ab - für selten vorkommende Sprachen im Mandat reicht der Umfang nicht. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Betreibers, gezeichnet 09/2026 | auf Anfrage |
| ChatGPT miniOpenAI · gpt-5.4-mini | auf Anfrage | EU-Region (Azure-Dienst) | EU (Sweden Central / West Europe); menschliche Missbrauchs-Sichtung nur mit Freigabe je Setup abgeschaltet | Schneller und günstiger als die große ChatGPT-Klasse, bei gleicher Bedienung. | Für mehrstufige Prüfungen und Analysearbeit ist die Reasoning-Stufe die passendere Wahl. | Abs.-4-Urkunde der Gosign GmbH; Amendment des Plattform-Anbieters | auf Anfrage |
| ChatGPT kompaktOpenAI · gpt-5.4-nano | auf Anfrage | EU-Region (Azure-Dienst) | EU (Sweden Central / West Europe); menschliche Missbrauchs-Sichtung nur mit Freigabe je Setup abgeschaltet | Die schnellste und sparsamste Stufe der Familie für Massenschritte in einer Verarbeitungskette. | Für inhaltliche Würdigung und Entwurfsarbeit ist diese Stufe nicht gebaut. | Abs.-4-Urkunde der Gosign GmbH; Amendment des Plattform-Anbieters | auf Anfrage |
| ChatGPT ReasoningOpenAI · o3 | auf Anfrage | EU-Region (Azure-Dienst) | EU (Sweden Central / West Europe); menschliche Missbrauchs-Sichtung nur mit Freigabe je Setup abgeschaltet | Arbeitet Prüfungsreihenfolgen Schritt für Schritt ab, statt in einem Zug zu antworten. | Deutlich längere Antwortzeiten - für Aufgaben in Menge ist die Stufe ungeeignet. | Abs.-4-Urkunde der Gosign GmbH; Amendment des Plattform-Anbieters | auf Anfrage |
| Mistral LargeMistral AI · mistral-large-2512 | auf Anfrage | EU-Endpunkt (Google-Plattform) | EU; die Abschaltung der Protokollierung klären wir vor der Einrichtung | Große europäische Ausbaustufe mit sicherer deutscher und französischer Sprachqualität. | Ohne fachliches Feintuning - Fundstellen und Fristen bleiben nachzuprüfen. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Plattform-Anbieters, gezeichnet 09/2026 | auf Anfrage |
| Mistral MediumMistral AI · mistral-medium-3-5 | auf Anfrage | EU-Endpunkt (Google-Plattform) | EU; die Abschaltung der Protokollierung klären wir vor der Einrichtung | Ausgewogen zwischen Tempo, Kosten und Qualität - die Arbeitsstufe für tägliche Zuarbeit. | Bei komplexer Analyse ist die große Stufe oder ein Reasoning-Modell die passendere Wahl. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Plattform-Anbieters, gezeichnet 09/2026 | auf Anfrage |
| Gemini ProGoogle · gemini-2.5-pro | auf Anfrage | EU-Endpunkt (Google-Plattform) | EU, Zero Retention vertraglich | Sehr großes Kontextfenster und die genaueste Gemini-Stufe für Vertrags- und Schriftsatzarbeit. | Höchste Preis- und Antwortzeitstufe der Familie - für Massenaufgaben zu schwer. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Plattform-Anbieters, gezeichnet 09/2026 | auf Anfrage |
| Gemini Flash LiteGoogle · gemini-3.5-flash-lite | auf Anfrage | EU-Endpunkt (Google-Plattform) | EU, Zero Retention vertraglich | Die schnellste und günstigste Gemini-Stufe - gebaut für Massenläufe über viele Dokumente. | Kompakte Modellklasse - Schriftsatzentwürfe und lange Herleitungen gehören auf eine größere Stufe. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Plattform-Anbieters, gezeichnet 09/2026 | auf Anfrage |
| Gemini EmbeddingGoogle | auf Anfrage | EU-Endpunkt (Google-Plattform) | EU; die Abschaltung der Protokollierung klären wir vor der Einrichtung | Macht den eigenen Aktenbestand nach Bedeutung durchsuchbar statt nach Wortgleichheit. | Erzeugt keine Antworten und keine Zusammenfassungen - dafür braucht es ein Sprachmodell dahinter. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Plattform-Anbieters, gezeichnet 09/2026 | auf Anfrage |
| Google Text-EmbeddingGoogle | auf Anfrage | EU-Endpunkt (Google-Plattform) | EU; die Abschaltung der Protokollierung klären wir vor der Einrichtung | Etablierte Embedding-Reihe mit mehrsprachiger Stufe für fremdsprachige Aktenbestände. | Vorgängergeneration - für einen neu aufgebauten Index ist die aktuelle Stufe meist die bessere Wahl. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Plattform-Anbieters, gezeichnet 09/2026 | auf Anfrage |
| Diktat und TranskriptionGoogle | auf Anfrage | EU-Endpunkt (Google-Plattform) | EU; die Abschaltung der Protokollierung klären wir vor der Einrichtung | Transkription über einen EU-Endpunkt, ohne eigene Hardware im Haus. | Die Qualität hängt an der Aufnahme - Nebengeräusche und Überlagerungen schlagen auf die Mitschrift durch. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Plattform-Anbieters, gezeichnet 09/2026 | auf Anfrage |
| Gemini SprachdialogGoogle | auf Anfrage | EU-Endpunkt (Google-Plattform) | EU, Zero Retention vertraglich | Sprache rein, Sprache raus in einem Durchgang - ohne getrennten Schritt für Mitschrift und Ausgabe. | Ein laufender Dialog überträgt fortlaufend Gesprochenes - eine Vorauswahl des Gesagten ist dabei kaum möglich. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Plattform-Anbieters, gezeichnet 09/2026 | auf Anfrage |
| Mistral OCRMistral AI | auf Anfrage | EU-Endpunkt (Google-Plattform) | EU; die Abschaltung der Protokollierung klären wir vor der Einrichtung | Liest Scans, Belege und Tabellen mit erhaltenem Layout aus - der Vorschritt jeder Aktenarbeit. | Bei Handschrift und schwachen Scans bleiben Erkennungsfehler - Zahlen und Fristen sind gegenzulesen. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Plattform-Anbieters, gezeichnet 09/2026 | auf Anfrage |
| E5 EmbeddingMicrosoft Research (E5-Modellreihe, offene Gewichte) | auf Anfrage | EU-Endpunkt (Google-Plattform) | EU; die Abschaltung der Protokollierung klären wir vor der Einrichtung | Offene Gewichte - derselbe Index lässt sich später ohne Neuberechnung im eigenen Betrieb weiterführen. | Reine Suchfunktion - Zusammenfassung, Würdigung und Entwurf leistet ein Embedding-Modell nicht. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Plattform-Anbieters, gezeichnet 09/2026 | auf Anfrage |
| ChatGPT für CodeOpenAI | auf Anfrage | EU-Region (Azure-Dienst) | EU (Sweden Central / West Europe); menschliche Missbrauchs-Sichtung nur mit Freigabe je Setup abgeschaltet | Auf Programmier- und Skriptarbeit ausgelegt, auch bei längeren Änderungen an bestehenden Dateien. | Kein Werkzeug der Aktenarbeit - die Reihe adressiert die IT der Kanzlei. | Abs.-4-Urkunde der Gosign GmbH; Amendment des Plattform-Anbieters | auf Anfrage |
| ChatGPT Modell-RouterOpenAI | auf Anfrage | EU-Region (Azure-Dienst) | EU (Sweden Central / West Europe); menschliche Missbrauchs-Sichtung nur mit Freigabe je Setup abgeschaltet | Wählt je Anfrage selbst die passende Größenklasse - kein Umschalten von Hand im Alltag. | Die Auswahl trifft der Dienst; ohne Protokoll ist im Einzelfall nicht ersichtlich, welche Stufe gearbeitet hat. | Abs.-4-Urkunde der Gosign GmbH; Amendment des Plattform-Anbieters | auf Anfrage |
| OpenAI EmbeddingOpenAI | auf Anfrage | EU-Region (Azure-Dienst) | EU (Sweden Central / West Europe); menschliche Missbrauchs-Sichtung nur mit Freigabe je Setup abgeschaltet | Grundlage für Suche über eigenen Beständen, ohne dass ein Sprachmodell den ganzen Bestand liest. | Ein Wechsel der Ausbaustufe erzwingt die Neuberechnung des gesamten Bestands. | Abs.-4-Urkunde der Gosign GmbH; Amendment des Plattform-Anbieters | auf Anfrage |
| OpenAI SprachausgabeOpenAI | auf Anfrage | EU-Region (Azure-Dienst) | EU (Sweden Central / West Europe); menschliche Missbrauchs-Sichtung nur mit Freigabe je Setup abgeschaltet | Verständliche deutsche Sprachausgabe für Aktenauszüge und Zusammenfassungen. | Erzeugt Audio aus Text - für Mitschrift und Diktat ist die Gegenrichtung zuständig. | Abs.-4-Urkunde der Gosign GmbH; Amendment des Plattform-Anbieters | auf Anfrage |
| OpenAI BildmodellOpenAI | auf Anfrage | EU-Region (Azure-Dienst) | EU (Sweden Central / West Europe); menschliche Missbrauchs-Sichtung nur mit Freigabe je Setup abgeschaltet | Erzeugt und bearbeitet Bilder aus Textbeschreibungen, auch an vorhandenen Vorlagen. | Kein Werkzeug der Aktenarbeit - es dient der Darstellung, nicht der Sachbearbeitung. | Abs.-4-Urkunde der Gosign GmbH; Amendment des Plattform-Anbieters | auf Anfrage |
| Cohere RerankCohere | auf Anfrage | EU-Region (Azure-Dienst) | EU (Sweden Central / West Europe); menschliche Missbrauchs-Sichtung nur mit Freigabe je Setup abgeschaltet | Hebt die einschlägigen Fundstellen nach oben und kürzt damit den Kontext für das Sprachmodell. | Liefert nur eine Rangfolge - ohne Suche davor und Sprachmodell dahinter kein nutzbares Ergebnis. | Abs.-4-Urkunde der Gosign GmbH; Amendment des Plattform-Anbieters | auf Anfrage |
| FLUX BildmodellBlack Forest Labs | auf Anfrage | EU-Region (Azure-Dienst) | EU (Sweden Central / West Europe); menschliche Missbrauchs-Sichtung nur mit Freigabe je Setup abgeschaltet | Bilderzeugung und Bildbearbeitung auf hohem Niveau, von einem Hersteller mit Sitz in Deutschland. | Kein Werkzeug der Aktenarbeit - die Reihe adressiert Darstellung, nicht Sachbearbeitung. | Abs.-4-Urkunde der Gosign GmbH; Amendment des Plattform-Anbieters | auf Anfrage |
| SprachausgabeGoogle | auf Anfrage | EU-Endpunkt (Google-Plattform) | EU; die Abschaltung der Protokollierung klären wir vor der Einrichtung | Erzeugt Sprache aus Text auf derselben Plattform, auf der die Textarbeit ohnehin läuft. | Die Stimmklonung betrifft die Stimme einer realen Person - ihr Einsatz ist vorab abzustimmen. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Plattform-Anbieters, gezeichnet 09/2026 | auf Anfrage |
| Gemini BildmodellGoogle | auf Anfrage | EU-Endpunkt (Google-Plattform) | EU, Zero Retention vertraglich | Bildbearbeitung auf derselben Plattform wie die Textarbeit - ohne weiteren Dienstleister. | Erzeugte Bilder geben keinen Sachverhalt wieder - in Anlagen sind sie als Erzeugnis zu kennzeichnen. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Plattform-Anbieters, gezeichnet 09/2026 | auf Anfrage |
| CodestralMistral AI · codestral-2508 | auf Anfrage | EU-Endpunkt (Google-Plattform) | EU; die Abschaltung der Protokollierung klären wir vor der Einrichtung | Code- und Automatisierungsarbeit auf derselben Plattform wie die übrige Textarbeit. | Kein Werkzeug der Aktenarbeit - Produktivdaten gehören nicht in Entwicklungs-Eingaben. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Plattform-Anbieters, gezeichnet 09/2026 | auf Anfrage |
| Amazon NovaAmazon Web Services | auf Anfrage | EU-Region (AWS-Plattform) | EU-Regionen des Plattform-Anbieters | Mehrere Größenstufen in einer Reihe - Tempo und Kosten lassen sich je Vorgang wählen, ohne die Bedienung zu wechseln. | Ohne fachliches Feintuning - Fundstellen und Fristen bleiben nachzuprüfen. | Grundlage nach § 203 klären wir vor der Einrichtung | auf Anfrage |
| Amazon Nova kompaktAmazon Web Services | auf Anfrage | EU-Region (AWS-Plattform) | EU-Regionen des Plattform-Anbieters | Die günstigste Stufe der Reihe - gebaut für Serienarbeit an vielen gleichartigen Vorgängen. | Kompakte Modellklasse - für Schriftsatz- und Analysearbeit sind die größeren Stufen der Reihe die passendere Wahl. | Grundlage nach § 203 klären wir vor der Einrichtung | auf Anfrage |
| Amazon Nova SpracheAmazon Web Services | auf Anfrage | EU-Region (AWS-Plattform) | EU-Regionen des Plattform-Anbieters | Gesprochene Ein- und Ausgabe in einem Modell - kein getrennter Schritt zwischen Mitschrift und Antwort. | Sprecherwechsel im Mehrpersonengespräch bleiben ein eigener Arbeitsschritt; Mitschriften sind vor der Ablage gegenzuhören. | Grundlage nach § 203 klären wir vor der Einrichtung | auf Anfrage |
| Amazon Nova BildmodellAmazon Web Services | auf Anfrage | EU-Region (AWS-Plattform) | EU-Regionen des Plattform-Anbieters | Bilderzeugung und Bildbearbeitung auf derselben Plattform wie die Textstufen der Reihe. | Kein Werkzeug der Sachbearbeitung - erzeugte Bilder geben keinen Sachverhalt wieder. | Grundlage nach § 203 klären wir vor der Einrichtung | auf Anfrage |
| Amazon Nova VideomodellAmazon Web Services | auf Anfrage | EU-Region (AWS-Plattform) | EU-Regionen des Plattform-Anbieters | Erzeugt Bewegtbild aus einer Textbeschreibung, ohne Dreh, Schnittplatz und eigene Produktion. | Video-Erzeugung bindet deutlich mehr Rechenzeit als Textarbeit - die Kostenfrage stellt sich anders als im Chat. | Grundlage nach § 203 klären wir vor der Einrichtung | auf Anfrage |
| Amazon EmbeddingAmazon Web Services | auf Anfrage | EU-Region (AWS-Plattform) | EU-Regionen des Plattform-Anbieters | Findet inhaltlich nahe Aktenstellen auch dann, wenn die gesuchten Wörter dort gar nicht vorkommen. | Erzeugt weder Text noch Bewertung - für Zusammenfassung und Entwurf braucht es ein Sprachmodell dahinter. | Grundlage nach § 203 klären wir vor der Einrichtung | auf Anfrage |
| Amazon RerankAmazon Web Services | auf Anfrage | EU-Region (AWS-Plattform) | EU-Regionen des Plattform-Anbieters | Hebt die Trefferqualität einer Aktensuche spürbar über das Ergebnis der reinen Embedding-Suche. | Liefert nur eine Rangfolge - ohne Suche davor und Sprachmodell dahinter entsteht kein nutzbares Ergebnis. | Grundlage nach § 203 klären wir vor der Einrichtung | auf Anfrage |
| Cohere EmbeddingCohere | auf Anfrage | EU-Region (AWS-Plattform) | EU-Regionen des Plattform-Anbieters | Mehrsprachige Einbettung - Anfrage und Fundstelle müssen nicht in derselben Sprache verfasst sein. | Reine Suchfunktion - Zusammenfassung, Würdigung und Entwurf leistet ein Embedding-Modell nicht. | Grundlage nach § 203 klären wir vor der Einrichtung | auf Anfrage |
| Qwen für CodeAlibaba Cloud (Qwen) | auf Anfrage | Deutsche Rechenzentren (Gosign-Kette) | Deutschland, Rechenzentrum nach ISO/IEC 27001, nicht beim Modellhersteller | Auf Code- und Automatisierungsarbeit ausgelegt, in zwei Größen von 30 und 80 Milliarden Parametern verfügbar. | Kein Werkzeug der Aktenarbeit - erzeugter Code ist wie fremder Code zu prüfen, bevor er in den Betrieb geht. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Betreibers, gezeichnet 09/2026 | auf Anfrage |
| Mistral kompaktMistral AI | auf Anfrage | Deutsche Rechenzentren (Gosign-Kette) | Deutschland, Rechenzentrum nach ISO/IEC 27001, nicht beim Modellhersteller | Kontextfenster von 128k trotz kompakter Modellgröße - auch längere Unterlagen passen in einen Vorgang. | 12 Milliarden Parameter - für lange Schriftsätze und mehrstufige Argumentation ist die Klasse zu klein. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Betreibers, gezeichnet 09/2026 | auf Anfrage |
| BGE EmbeddingBAAI | auf Anfrage | Deutsche Rechenzentren (Gosign-Kette) | Deutschland, Rechenzentrum nach ISO/IEC 27001, nicht beim Modellhersteller | Drei Repräsentationsarten aus einem Modell bei rund 4 GB Bedarf - läuft neben dem Sprachmodell auf derselben Karte. | Ordnet den Bestand vor und beantwortet keine Frage - die fachliche Beurteilung der Treffer bleibt Aufgabe der Kanzlei. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Betreibers, gezeichnet 09/2026 | auf Anfrage |
| Qwen EmbeddingAlibaba Cloud (Qwen) | auf Anfrage | Deutsche Rechenzentren (Gosign-Kette) | Deutschland, Rechenzentrum nach ISO/IEC 27001, nicht beim Modellhersteller | 32.768 Token Eingabe - längere Passagen werden am Stück eingeordnet, ohne sie vorher zu zerteilen. | Deutlich größer als die kompakten Embedding-Modelle - der Genauigkeitsgewinn kostet Rechenzeit und Platz. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Betreibers, gezeichnet 09/2026 | auf Anfrage |
| Qwen RerankAlibaba Cloud (Qwen) | auf Anfrage | Deutsche Rechenzentren (Gosign-Kette) | Deutschland, Rechenzentrum nach ISO/IEC 27001, nicht beim Modellhersteller | Rund 4 GB Bedarf - passt neben Sprachmodell und Embedding auf dieselbe Karte. | Nebenrolle in der Suchstrecke - ohne Embedding davor und Sprachmodell dahinter ohne Funktion. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Betreibers, gezeichnet 09/2026 | auf Anfrage |
| Mehrsprachiges EmbeddingSentence-Transformers (offene Gewichte) | auf Anfrage | Deutsche Rechenzentren (Gosign-Kette) | Deutschland, Rechenzentrum nach ISO/IEC 27001, nicht beim Modellhersteller | Mehrsprachig bei sehr geringem Ressourcenbedarf - die sparsamste Stufe für Kurztext-Ähnlichkeit. | 128 Token Kontext - ganze Aktenpassagen passen nicht hinein, dafür sind die größeren Embedding-Modelle zuständig. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Betreibers, gezeichnet 09/2026 | auf Anfrage |
| Jina EmbeddingJina AI | auf Anfrage | Deutsche Rechenzentren (Gosign-Kette) | Deutschland, Rechenzentrum nach ISO/IEC 27001, nicht beim Modellhersteller | Ausdrücklich auf Deutsch ausgelegt - passend zum Sprachprofil einer deutschen Kanzlei. | Auf Deutsch ausgelegt - für stark mehrsprachige Bestände sind die mehrsprachigen Embedding-Modelle die passendere Wahl. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Betreibers, gezeichnet 09/2026 | auf Anfrage |
| TexterkennungLightOn | auf Anfrage | Deutsche Rechenzentren (Gosign-Kette) | Deutschland, Rechenzentrum nach ISO/IEC 27001, nicht beim Modellhersteller | Wandelt Scans in verarbeitbaren Text und bleibt kompakt genug für Massenläufe über ganze Aktenbestände. | Handschrift und schwache Scan-Qualität bleiben die bekannten Schwachstellen - Stichproben gegen das Original bleiben nötig. | Abs.-4-Urkunde der Gosign GmbH; Verschwiegenheitsvereinbarung des Betreibers, gezeichnet 09/2026 | auf Anfrage |
Womit anfangen
Zwei Empfehlungen, je nach Haus
Für Anwaltskanzleien
Beginnen Sie mit Claude Sonnet für Entwürfe und Zuarbeit und Claude Opus für lange Schriftsätze und Verträge, bei denen der rote Faden über viele Seiten halten muss. Für Aktenkonvolute und Massensichtung ist Gemini Flash die schnellere Wahl. Wer möchte, dass die Eingaben in Deutschland bleiben und kein Modellhersteller sie erhält, arbeitet mit Mistral 4 - betrieben über die Gosign-Kette in deutschen Rechenzentren.
Für Steuerberatung und Wirtschaftsprüfung
Für strukturierte Auswertung aus Unterlagen - Belege, Jahresabschlüsse, Prüfungsdokumentation - eignen sich Gemini Flash und Qwen. Bei mehrstufigen Prüfungen und Fristenketten rechnet DeepSeek Schritt für Schritt durch. Für den täglichen Schriftverkehr genügt Claude Sonnet. Auch hier gilt: Wer die Eingaben in deutschen Rechenzentren halten will, bleibt bei den offenen Modellen der Gosign-Kette.
Nicht im Angebot
Was Sie bei uns nicht bekommen - und warum
Kimi (Moonshot AI)
Nicht mehr im Angebot: Der Betreiber hat das Modell zum 11.09.2026 abgekündigt.
Claude Fable (Anthropic)
Für Mandatsarbeit nicht im Angebot: Der Anbieter verlangt für diese Klasse die Weitergabe der Ein- und Ausgaben.
Claude Mythos (Anthropic)
Für Mandatsarbeit nicht im Angebot: Der Anbieter verlangt für diese Klasse die Weitergabe der Ein- und Ausgaben.
Sie müssen sich nicht zwischen den Modellen entscheiden
In Ihrer Instanz sind sie alle da, und Ihr Team wählt pro Vorgang aus. Was ein Modell kostet, hängt nicht vom Modell ab, sondern vom Paket: In jedem sind 100 € KI-Budget im Monat enthalten, und Sie sehen den Verbrauch tagesaktuell je Person.
Sie starten selbst: kein Termin, keine Zahlungsdaten. Wenn Sie zuerst die berufsrechtliche Seite prüfen wollen - welches Modell über welchen Bezugsweg trägt, mit Quellen und Stand - dokumentiert das Gosign, das Unternehmen hinter veryAI: der 203er-Modellkatalog auf gosign.de.