微软计划用中国Kimi K3算法替换GPT和Claude来节省高达6亿美元(2)

2026-07-22 10:16  头条

该模型不仅具备百万级别的长上下文理解能力,还在混合专家(MoE)架构上实现了极高的硬件运行效率。

微软工程师评估发现,Kimi K3通过内置的KV缓存优化和896个专家的分布式调度,显著降低了单位Token占用的显存资源。

在数据中心规模的算力集群上,这种极高的硬件利用率转化为极其诱人的运行经济性。

对于按消耗量计费的 Copilot 企业级服务而言,这种算力效率的提升直接决定了微软在AI工具链中的毛利润率。

在性能表现相差无几的前提下,引入高性能开源模型作为降本备选,成为了微软难以抗拒的商业选择。