Microsoft har afsløret Maia 200, en specialbygget inference-accelerator designet til at forbedre økonomien i AI-token-generering dramatisk.
Performance
Chippen er den mest performante first-party silicium fra nogen hyperscaler, med tre gange FP4-performance sammenlignet med Amazons tredje generation Trainium.
Udrulning
Den vil betjene flere modeller inklusive OpenAIs seneste GPT-5.2 modeller og rulles først ud i Microsofts datacenter i Des Moines, Iowa.