MiniMax Modellübersicht: Sprach-, Video-, Audio- und Musik-APIs

ArtikelMiniMaxSammlung

Die API-Dokumentation von MiniMax listet die verfügbaren und älteren KI-Modelle für Sprache, Videogenerierung, Sprachsynthese und Musik auf. Zu den aktuellen Spitzenmodellen gehören MiniMax-M3 mit einem Kontextfenster von 1 Million Tokens sowie die Videomodelle MiniMax H3 und H3 Max.

Das Wichtigste

  1. Sprachmodelle: MiniMax-M3 bietet multimodale Programmierfähigkeiten und 1M Kontextlänge; daneben stehen M2.7 und die M2.7-highspeed-Variante mit niedriger Latenz bereit.
  2. Videomodelle: MiniMax H3 unterstützt Text-to-Video und Image-to-Video mit bis zu 2K-Auflösung bei 24 fps; MiniMax H3 Max wurde von fal.ai für schnellere Generierung nachtrainiert.
  3. Sprachsynthese: speech-2.8-hd und speech-2.8-turbo unterstützen 40 Sprachen und 7 Emotionen.
  4. Änderungen bei Musik-APIs: Seit dem 20. August 2026 sind kostenpflichtige Musik-APIs für Neukunden gesperrt und kostenlose APIs eingestellt; Verwiesen wird auf MiniMax Audio und das Open-Source-Modell MiniMax Music 3 auf Hugging Face.

Warum das relevant ist

Die Dokumentation zeigt den aktuellen Stand der Multimodal- und Programmiermodelle von MiniMax. Entwickler erhalten einen präzisen Überblick über unterstützte Auflösungen, Kontextfenster und den Modellstatus bei API-Umstellungen.

Einordnung

MiniMax strukturiert sein Portfolio klar in Kernbereiche: Flaggschiff-Modelle wie M3 setzen auf sehr große Kontextfenster (1M Tokens), während spezialisierte Highspeed-Varianten auf niedrige Latenz abzielen. Auffällig ist die Kooperation mit fal.ai für das optimierte Videomodell H3 Max sowie der schrittweise Rückzug aus öffentlich zugänglichen Musik-APIs zugunsten von Open-Source-Angeboten auf Hugging Face.

Gefunden in

Zusammenfassung von KI erstellt (Gemini 3.8 Flash, 27. September 2026). Sie kann Fehler enthalten – maßgeblich ist die Originalquelle.

Inhaltlich ähnlich, ermittelt über die KI-Suche.

  • Artikel:MiniMax Research

    MiniMax stellt multimodales Generierungsmodell H3 vor

    MiniMax hat MiniMax H3 vorgestellt, ein universelles multimodales Generierungsmodell für Text, Bild, Video und Audio. Das Modell erzeugt bis zu 15 Sekunden langes Video in nativer 2K-Auflösung inklusive nativem Stereo-Sound und soll in Kürze quelloffen verfügbar sein.

    KI & AI· Ankündigung

  • Repository:MiniMax-AI/MiniMax-H3

    MiniMax-H3: Agent-Skills für Videogenerierungs-Prompts

    MiniMax-H3 stellt ein Repository mit neun Agent-Skills bereit, darunter ein spezialisierter Prompt-Writing-Skill für die H3-Videomodelle von MiniMax und Hailuo AI.

    8076SternePython

    KI & AI· Sammlung

  • Artikel:agent.minimax.io

    MiniMax Agent Changelog: Neuerungen von Version 3.0.46 bis 3.0.68

    Das Änderungsprotokoll von MiniMax Code dokumentiert die Weiterentwicklung des Desktop- und CLI-Agenten im Sommer 2026. Zu den zentralen Neuerungen gehören ein überarbeiteter Kern mit reduzierter Latenz, Browser-Automatisierung, MCP-Server-Verwaltung, Goal-Modus sowie die Einbindung des H3-Videomodells.

    KI & AI· Ankündigung

Lassen Sie uns über Ihr Projekt sprechen

Standorte

  • Mattersburg
    Johann Nepomuk Bergerstraße 7/2/14
    7210 Mattersburg, Austria
  • Wien
    Ungargasse 64-66/3/404
    1030 Wien, Austria

Dieser Inhalt wurde teilweise mithilfe von KI erstellt.