OpenAI dokumentiert Flaggschiff-Modell GPT-5.4 mit 1,05 Millionen Kontextfenster

ArtikelOpenAISammlung

Die offizielle Dokumentation stellt das Flaggschiff-Modell GPT-5.4 für komplexe professionelle Aufgaben und Coding vor. Das Modell bietet ein Kontextfenster von 1.050.000 Tokens, bis zu 128.000 Output-Tokens sowie anpassbare Reasoning-Stufen.

Das Wichtigste

  1. Kontextfenster von 1.050.000 Tokens und maximal 128.000 Tokens pro Ausgabe.
  2. Unterstützt Reasoning-Stufen von none (Standard) über low, medium und high bis xhigh.
  3. Preise betragen 2,50 USD pro 1M Input-Tokens (0,25 USD für Cached Input) und 15,00 USD pro 1M Output-Tokens.
  4. Prompts über 272.000 Input-Tokens kosten die doppelten Input- und 1,5-fachen Output-Preise; regionale Datenverarbeitung schlägt mit 10 Prozent Aufschlag zu Buche.
  5. Unterstützt Chat Completions, Responses API und Batch-Verarbeitung, inklusive Werkzeugen wie hosted_shell, apply_patch, skills, mcp und computer_use.
  6. Wissensstand ist der 31. August 2025; der Standard-Snapshot lautet gpt-5.4-2026-03-05.

Warum das relevant ist

Für Entwickler und Unternehmen bringt GPT-5.4 eine enorme Kontextlänge und native Tool-Integrationen wie MCP, computer_use und Patch-Anwendungen. Die Preisaufschläge bei über 272K Tokens sowie regionalem Hosting müssen jedoch bei der Budgetierung von Long-Context-Workflows berücksichtigt werden.

Einordnung

Mit GPT-5.4 konsolidiert OpenAI erweiterte Agenten-Werkzeuge in der Responses API. Funktionen wie hosted_shell, apply_patch und MCP zeigen eine klare Ausrichtung auf autonome Programmier- und Systemadministrations-Workflows. Auffällig ist die Preisstaffelung für sehr lange Kontexte ab 272.000 Tokens, die den rechnerischen Mehraufwand für extrem umfangreiche Sitzungen reflektiert.

Gefunden in

Zusammenfassung von KI erstellt (Gemini 3.8 Flash, 27. September 2026). Sie kann Fehler enthalten – maßgeblich ist die Originalquelle.

Inhaltlich ähnlich, ermittelt über die KI-Suche.

  • Link:Together AI

    Together AI stellt Qwen3.7-Max mit 1M Kontextfenster per API bereit

    Together AI bietet das proprietäre Flaggschiff-Modell Qwen3.7-Max über seine API an. Das Modell verfügt über ein Kontextfenster von einer Million Token und wurde speziell für autonome Agenten, Softwareentwicklung und lange Ausführungszeiten trainiert.

    KI & AI· Ankündigung

  • Link:Anthropic

    Anthropic stellt Claude Opus 5 vor

    Anthropic hat Claude Opus 5 veröffentlicht. Das Spitzenmodell zielt auf anspruchsvolle Programmieraufgaben, autonome Agenten und komplexe Unternehmens-Workflows ab. Über konfigurierbare Effort-Stufen lässt sich die Rechentiefe anpassen. Entwickler können das Modell direkt über die API sowie auf AWS, Google Cloud und Microsoft Foundry nutzen.

    KI & AI· Ankündigung

  • Artikel:Anthropic

    Anthropic stellt Claude Opus 4.6 mit 1M-Kontextfenster vor

    Anthropic hat Claude Opus 4.6 veröffentlicht. Das Modell bietet verbesserte Programmier- und Planungsfähigkeiten, ein 1-Million-Token-Kontextfenster in der Beta und neue Steuerungsoptionen wie adaptive Thinking und Effort-Parameter bei unveränderten Token-Preisen.

    KI & AI· Ankündigung

  • X-Post:darkzodchi

    GPT-6 Astra im Produktivbetrieb: Kostenfallen und Optimierung

    Ein Leitfaden von darkzodchi analysiert technische Limits und Preisstrukturen von OpenAIs GPT-6 Astra. Trotz eines Kontextfensters von 1,05 Millionen Tokens führen verdeckte Preissprünge und TPM-Beschränkungen schnell zu unerwarteten Kosten.

    2409Lesezeichen224.201Aufrufe

    KI & AI· Anleitung

Lassen Sie uns über Ihr Projekt sprechen

Standorte

  • Mattersburg
    Johann Nepomuk Bergerstraße 7/2/14
    7210 Mattersburg, Austria
  • Wien
    Ungargasse 64-66/3/404
    1030 Wien, Austria

Dieser Inhalt wurde teilweise mithilfe von KI erstellt.