Das KI-Labor inclusionAI von Ant Group hat am 4. September 2026 Ling 3.0 Flash Sante vorgestellt – eine auf Medizin spezialisierte Variante seines quelloffenen Sprachmodells, die zunaechst nur ueber Programmierschnittstellen verfuegbar ist.
Was das Modell kann
Sante baut auf Ling 3.0 Flash auf, einem Mixture-of-Experts-Modell mit 124 Milliarden Parametern, von denen pro Token nur rund 5,1 Milliarden aktiv sind. Die hybride Architektur kombiniert Kimi Delta Attention mit Multi-Head Latent Attention und verarbeitet Kontexte von bis zu 262.144 Token. Die Medizinvariante ist auf klinisches Schliessen, evidenzbasierte Recherche und lange Diagnoseketten getrimmt, behaelt laut Anbieter aber allgemeine Faehigkeiten in Logik und Programmierung.
Offene Gewichte – mit einer Einschraenkung
Das Basismodell Ling 3.0 Flash steht unter der freizuegigen MIT-Lizenz auf Hugging Face bereit und erreicht im Intelligence Index des Analysehauses Artificial Analysis rund 38 Punkte – bei hoher Geschwindigkeit von mehr als 300 Token pro Sekunde. Fuer die Sante-Version hat inclusionAI die Gewichte bislang jedoch nicht veroeffentlicht; sie laeuft ausschliesslich ueber die Schnittstellen der Anbieter.
Zahlen mit Vorsicht zu geniessen
InclusionAI nennt fuer Sante einen DiagnosisArena-MCQ-Wert von 83,8 – ein herstellereigener Benchmark, der bislang von keiner unabhaengigen Stelle bestaetigt wurde. Die Plattformen weisen zudem ausdruecklich darauf hin, dass es sich nicht um ein Medizinprodukt handelt und das Modell aerztliches Urteil nicht ersetzt. Fuer Kliniken und Entwickler in Deutschland bleibt damit offen, wie sich das System jenseits der Werbeversprechen im Alltag schlaegt.
Quellen: Artificial Analysis · OpenRouter · Hugging Face



















