DAX -0,22 % 25.099,00 Pkt 18:00:00 MDAX -0,05 % 31.965,53 Pkt 18:00:00 Euro Stoxx 50 +1,14 % 6.280,94 Pkt 18:00:00 Dow Jones -0,52 % 51.947,25 Pkt 23:26:43 S&P 500 -1,16 % 7.411,98 Pkt 23:26:35 Nasdaq -2,78 % 24.975,82 Pkt 23:15:59 Nikkei -2,73 % 64.611,15 Pkt 08:45:03 Gold +0,08 % 4.070,80 USD 22:59:59 Silber +0,43 % 58,91 USD 22:59:55 Brent 0,00 % 96,78 USD 22:59:55 WTI 0,00 % 89,31 USD 22:59:59 Bitcoin +0,21 % 64.447,15 USD 07:18:55 EUR/USD -0,32 % 1,13750 USD 23:29:21 EUR/GBP 0,00 % 0,85320 GBP 06:49:20 EUR/CHF +0,06 % 0,92970 CHF 06:49:20 EUR/JPY +0,08 % 186,245 JPY 23:29:21

Microsoft MAI-Serie: Neue KI-Modelle sparen bis zu 89% GPU-Kosten

Allgemein

Der Konzern aus Redmond hat am 23. Juli eine neue Generation hauseigener KI-Modelle vorgestellt. Die MAI-Serie soll teure Frontier-Modelle bei Routineaufgaben ersetzen – und das zu einem Bruchteil der Kosten. Durchbruch bei der Kosteneffizienz Mit MAI-Image-2.5-Pro und MAI-Voice-2-Flash starten gleich zwei neue Modelle in die öffentliche Testphase. Die interne Entwicklung zahlt sich aus: Gegenüber externen Spitzenmodellen sparen die neuen Systeme bis zu 89 Prozent der GPU-Kosten ein. Besonders beeindruckend sind die konkreten Einsparungen in Microsofts eigener Produktpalette. In PowerPoint senkt MAI-Image-2.5 die GPU-Kosten um 84 Prozent im Vergleich zur bisherigen GPT-Image-2-Implementierung. Noch deutlicher fällt der Sprung im Dynamics 365 Contact Center aus: Hier reduziert MAI-Voice-2-Flash die Kosten um 89 Prozent. Das Sprachmodell arbeitet zudem doppelt so schnell wie sein Vorgänger und ist 32 Prozent günstiger – bei einem Preis von 15 Euro pro Million Zeichen. Für die Bildgenerierung setzt Microsoft künftig auf MAI-Image-2.5-Pro als Standard im Bing Image Creator. Das Modell verarbeitet Texteingaben von bis zu 32.000 Token und kostet 5 Euro pro Million Text-Token, 8 Euro pro Millionen Bild-Token und 106 Euro pro Millionen ausgegebener Bild-Token. Produktivitätsschub für Entwickler und Unternehmen Anzeige Die rasante Entwicklung neuer KI-Modelle stellt Unternehmen auch vor rechtliche Herausforderungen durch den EU AI Act. Dieser kostenlose Download verschafft Ihnen den Überblick über Fristen und Pflichten, den Ihre Rechts- und IT-Abteilung jetzt dringend braucht. EU AI Act in 5 Schritten verstehen: Fristen, Pflichten und Risikoklassen kompakt erklärt Die neue Modellfamilie durchdringt das gesamte Microsoft-Ökosystem. In GitHub Copilot kommt MAI-Code-1-Flash zum Einsatz – mit beeindruckenden Ergebnissen: Die Code-Akzeptanzrate liegt zehn Prozent über der von GPT-5.4 Mini und Claude Haiku 4.5, bei gleichzeitig zehn Prozent weniger Token-Verbrauch. Auch Excel profitiert: Ein spezialisiertes MAI-Modell erreicht bei alltäglichen Aufgaben die Leistung von GPT-5.6, läuft aber auf kostengünstigerer H100- und A100-Hardware. Bei OneDrive führte der Wechsel zu 26 Prozent höheren Speicherraten und einer um etwa 25 Prozent gesunkenen P95-Latenz. Im Gesundheitssektor zeigt sich die Stärke der neuen Modelle besonders deutlich. Dragon Copilot, das von 170.000 medizinischen Fachkräften genutzt wird, setzt nun auf MAI-Transcribe-1.5. Die Transkriptionsfehlerquote sank dadurch um 50 Prozent – und das in 58 Sprachen. Strategische Neuausrichtung: Frontier Diffusion Microsoft-CEO Satya Nadella skizzierte mit der Ankündigung die neue Strategie des Konzerns. „Frontier Diffusion and Control“ heißt das Konzept: KI-Verkehr wird intelligent auf spezialisierte interne MAI-Modelle gelenkt, sobald diese bei bestimmten Aufgaben mit teuren Frontier-Modellen mithalten oder sie übertreffen. Die rechenintensiven Spitzenmodelle bleiben so nur den komplexesten Workloads vorbehalten. Mustafa Suleyman ergänzte, dass MAI-Modelle bereits in mehr als der Hälfte aller Microsoft-Produkte zum Einsatz kommen. Erste Kunden aus der Geschäftsprozessauslagerung – darunter T-Mobile und EasyJet – setzen die KI-Sprachmodelle bereits im Kundenservice ein. Anzeige Während Microsoft die Effizienz seiner KI-Systeme steigert, müssen Unternehmen die neuen Regeln für Hochrisiko-Systeme kennen. Dieser kostenlose Report klärt auf, welche KI-Systeme unter die neue Verordnung fallen und was Verantwortliche jetzt konkret tun müssen. Welche KI-Systeme gelten als Hochrisiko – und was müssen Unternehmen jetzt konkret tun? Hardware-Offensive: AMD und neue Partnerschaften Die neue Modellstrategie erfordert eine leistungsfähige Infrastruktur. Microsoft treibt daher seine Silicon-Diversity-Strategie voran. Am 23. Juli gab das Unternehmen die Bereitstellung der AMD Helios-Rack-Scale-Plattform auf Azure für Frontier-Modell-Inferenz bekannt. Neue AMD EPYC-Virtual-Maschinen-Familien und die Azure Cobalt 200-Infrastruktur sollen laut Microsoft eine um bis zu 50 Prozent bessere Leistung bieten.

← Zurück zu News

Bereit für Ihre kostenlose E-Mail?

512 MB Speicher, modernes Webmail und ein News-Portal — kostenlos starten.

Jetzt kostenlos registrieren