Sakanas neues Model ist kein Model, sondern ein Dispatcher für andere Models
Fugu Max und Fugu Ultra v2, veröffentlicht am 11. September, beantworten Ihre Frage nicht selbst. Sie wählen aus einem Pool offener und spezialisierter Modelle aus, welches Modell sie verwenden sollten, und mit 2 Dollar pro Million Input-Token unterbietet Fugu Max die Grenzstufe um die Hälfte.
Sakana AI hat am 11. September zwei neue Systeme veröffentlicht, Fugu Max und Fugu Ultra v2, und das Interessante daran ist, was sie nicht sind. Es gibt auch kein einziges großes Modell, das das Internet liest und jetzt Ihre Fragen beantwortet. Jeder ist ein Orchestrator: ein Modell, dessen eigentliche Fähigkeit darin besteht, zu entscheiden, welches andere Modell die vor ihm liegende Aufgabe übernehmen soll, und die Arbeit dann zu übergeben, manchmal nacheinander an mehrere Modelle, manchmal an eine andere Kopie seiner selbst. Der Pool, an den es weiterleitet, besteht hauptsächlich aus Modellen mit offenem Gewicht und Spezialisten, d. h. Modellen, deren Dateien jeder herunterladen und ausführen kann.
Der Preis ist die Tonhöhe. Fugu Max kostet 2 Dollar pro Million Input-Token und 6 Dollar pro Million Output, etwa 40 bis 60 Prozent unter Sonnet 5 und GPT-5.6 Terra, und Sakana gibt an, dass es bei sechs von zehn Benchmarks, die es meldet, am besten abschneidet, darunter Terminal Bench 2.1 und GPQA Diamond. Fugu Ultra v2 zielt höher und kostet mehr, 5 Dollar rein und 30 raus, wobei längere Eingabeaufforderungen zu einem höheren Preis abgerechnet werden, und meldet 48,3 bei Chartography und 74,3 bei DeepSWE. Sakana weist ausdrücklich darauf hin, dass diese Zahlen ohne Fable 5, Fable 5.1 oder GPT-6 Astra in seinem Pool erreicht werden, sodass die Ergebnisse aus günstigeren, gut zusammengebauten Teilen stammen. Beide sitzen hinter einer API, die das gleiche Format wie OpenAI spricht, sodass der Wechsel meist eine Adressänderung ist. Eine Zeile im Kleingedruckten verdient Beachtung: Das Routing selbst verbraucht Token und diese werden in Rechnung gestellt.
Was steckt dahinter
Die unausgesprochene Annahme der letzten drei Jahre war, dass man ein größeres Modell kauft, wenn man eine bessere Antwort will. Routing stellt dies in Frage. Die meisten Anfragen sind nicht schwer. Eine E-Mail zusammenfassen, einen Absatz umschreiben, einen offensichtlichen Fehler beheben: Ein kleines offenes Modell erledigt das alles perfekt und zu einem Bruchteil der Kosten, und nur eine Minderheit der Anfragen benötigt wirklich das teure Argumentationsmodell. Ein Router, der die beiden unterscheiden kann, bietet die meiste Qualität für einen Bruchteil des Geldes. Der Haken ist, dass ein Router eine weitere Sache ist, die falsch sein kann, und zwar auf eine Art und Weise, die beim Debuggen lästig ist, denn eine Antwort, die mittelmäßig ausgefallen ist, könnte eine schlechte Antwort sein oder einfach eine schlechte Wahl, wer geantwortet hat. Und die Benchmark-Zahlen hier stammen von Sakana und basieren auf von Sakana ausgewählten Benchmarks.
Was das für Sie bedeutet: Wenn Sie KI über ein Chat-Fenster verwenden, ändert sich dadurch nichts, was Sie sehen können, aber es ist gut zu verstehen, denn Routing wird im Stillen auch zur Arbeitsweise der großen Assistenten. Deshalb fühlt sich das gleiche Produkt manchmal brillant und manchmal langweilig an: Man spricht nicht immer mit demselben Modell. Wenn Sie für die API-Nutzung bezahlen, ist Fugu Max einen ehrlichen Test an Ihrem eigenen Arbeitsaufwand wert, denn eine 40 bis 60-prozentige Kürzung einer Rechnung, die Sie bereits bezahlen, ist echtes Geld. Zwei Vorsichtsmaßnahmen, bevor Sie etwas Wichtiges verschieben: Führen Sie Ihren eigenen Vergleich durch, anstatt dem Startdiagramm zu vertrauen, und beziehen Sie die Orchestrierungs-Tokens in Ihre Berechnungen ein, bevor Sie entscheiden, dass es günstiger ist.
Quellen
Quellen: https://sakana.ai/fugu-max-release/
DeepMind hat eine Vorhersage für jeden einzelnen Buchstaben veröffentlicht, den Sie in der menschlichen DNA ändern könnten
AlphaGenome Atlas ist ein ein Petabyte großer Datensatz, der alle 9 Milliarden möglichen Einzelbuchstaben-DNA-Varianten abdeckt und vorberechnet wurde, damit Forscher nach einer Antwort suchen können, anstatt ein Modell ausführen zu müssen. Für nichtkommerzielle Forschung ist es kostenlos.