Microsoft har afsløret Maia 200, en specialbygget inference-accelerator designet til at forbedre økonomien i AI-token-generering dramatisk.

Performance

Chippen er den mest performante first-party silicium fra nogen hyperscaler, med tre gange FP4-performance sammenlignet med Amazons tredje generation Trainium.

Udrulning

Den vil betjene flere modeller inklusive OpenAIs seneste GPT-5.2 modeller og rulles først ud i Microsofts datacenter i Des Moines, Iowa.