Link:primeintellect.ai
Mixedbread trainiert Deep-Search-Agent Toast 1 mit Prime-RL
In einer Fallstudie beschreibt Prime Intellect, wie das Unternehmen Mixedbread das Modell Toast 1 mithilfe von Prime-RL und Verifiers v1 trainiert hat. Der auf Qwen3.6-35B-A3B basierende Retrieval-Subagent erzielt bei der Informationsbeschaffung Ergebnisse auf dem Niveau führender Modelle, arbeitet dabei jedoch 12-mal schneller und deutlich kosteneffizienter.
Aus Video: AI Weekly Updates: Open-Source Model Surge, Agent Harnesses, and Meta's AI Reality Check