Large 4 ist nach Angaben von Mistral AI das bisher größte und leistungsfähigste Modell des Unternehmens. Die öffentliche Vorschau lässt sich über die API in Mistral Studio ausprobieren. Mistral kündigt an, die Modellgewichte bis Ende des Monats freizugeben. Das Modell soll zudem als Grundlage für eine neue Generation spezialisierter Mistral-Modelle dienen.
Trainiert wurde Large 4 laut Mistral AI von Grund auf mit 3.800 NVIDIA Grace Blackwell GPUs in unternehmenseigenen Rechenzentren in Europa. Das Modell ist nativ multimodal und wurde mit mehrsprachigen Daten trainiert, die mehr als 160 Sprachen abdecken. Mistral nennt Programmierung, agentische Arbeitsabläufe und multimodales Verstehen als Einsatzbereiche. Für die Vorschau nutzt das Unternehmen dieselbe Infrastruktur wie beim Training.
Mistral hebt besonders die Ergebnisse bei Cybersicherheitsaufgaben hervor. Im Artificial Analysis Cyber Index liege Large 4 unter den fünf weltweit führenden Modellen und führe bei den Open-Weight-Modellen, die außerhalb Chinas entwickelt wurden. Bei einer Aufgabe, eine reale Sicherheitslücke in Open-Source-Software nachzustellen und anschliessend zu beheben, erreiche das Modell laut Mistral 82 Prozent. In Cybench, einer Sammlung von 40 Aufgaben aus Sicherheitswettbewerben, löse es 93 Prozent der Herausforderungen. Diese Leistungsangaben stammen von Mistral; das Unternehmen verweist dabei auf unabhängige Tests und eigene interne Prüfungen.
Bis zur Veröffentlichung der Gewichte führt Mistral nach eigenen Angaben Red-Team-Tests unter realen Bedingungen durch. Beteiligt seien Fachleute für Cybersicherheit, ausgewählte Partner und staatliche Stellen, die eine Version mit reduzierter Moderation und erweiterten Cyber-Fähigkeiten erhalten. Mistral will weitere Angaben zur Architektur, zusätzliche Benchmarks und Informationen zum Post-Training veröffentlichen. Die Gewichte sollen Organisationen laut Unternehmen ermöglichen, das Modell in einer privaten Cloud oder vor Ort selbst zu betreiben.
