🔖独家报道 😀微软计划明年大幅增产内部设计的新一代 AI 芯片,希望说服 Anthropic 这类大型云公司使用该芯片,以上信息来自两位了解相关计划的知情人士。

图片

无图片

正文

🔖独家报道 😀微软计划明年大幅增产内部设计的新一代 AI 芯片,希望说服 Anthropic 这类大型云公司使用该芯片,以上信息来自两位了解相关计划的知情人士。 🤔尽管当前一代微软自研芯片 Maia 200 落地推进节奏缓慢,知情人士透露,微软计划在今年秋季,最早可能在下个月,公开发布全新 Maia 300 芯片。另有知情人士表示,这家云计算巨头已经和台积电开展洽谈,计划锁定超过 30 万颗芯片的制造产能,2027 年完成交付,该规模相比微软至今已经产出的数万颗 Maia 200 芯片提升一个数量级。 ✅ 👉微软计划于 9 月发布下一代 Maia 300 AI 芯片 👉该公司正计划加大自身对 Maia 芯片的使用规模,同时积极争取大型公司客户 👉微软认为 Maia 芯片能够以更低成本运行内部模型以及 OpenAI 模型 📑知情人士称,微软的终极目标是拿到超过 100 万颗 Maia 300 芯片的产能,但零部件供应约束、和台积电之间正在推进的产能谈判,会对该目标形成制约。 💡推进 Maia 芯片落地,是微软降低对英伟达芯片依赖的关键举措,也是公司 CEO 萨提亚・纳德拉的优先工作事项。此前相关推进工作遭遇阻碍,Maia 200 芯片早期测试没有达成内部目标,发布时间因此推迟至去年,发布之后,该芯片也仅在微软少数数据中心内部投入使用。 🗣️微软 Azure Maia 部门总经理安德鲁・沃尔发布声明,拒绝针对具体生产计划作出评价,但他表示微软最终希望生产吉瓦级体量的 Maia 芯片。沃尔没有给出具体数量与时间节点,但具备多吉瓦供电能力的数据中心,通常会部署数百万颗 AI 芯片。 💬沃尔表示:“微软持续投入定制芯片研发,这属于我们长期 AI 基础设施战略的组成部分。虽然我们不会对外披露生产规模,但外界报道的数字,并没有反映项目实际体量。我们预计 Azure Maia 的部署工作,可以支撑吉瓦量级的 AI 工作负载需求。” 📊在 AI 自研芯片推进这件事上,微软落后于谷歌、亚马逊等竞争对手。谷歌、亚马逊已经拿下大量公司客户,分别把张量处理单元、Trainium 芯片部署到自家云业务当中,谷歌还已经对外出售 TPU,供给自家数据中心以外的客户使用。与之形成对比,到目前为止,微软只有自身在使用 Maia 芯片,用来运行 OpenAI 模型以及自研 MAI 模型,为 Copilot AI 软件提供算力支撑。但绝大多数相关软件的运行,微软依旧主要依靠英伟达芯片。 🤞微软有信心争取更多客户选用即将推出的 Maia 300 芯片,Anthropic 会是潜在客户,核心原因是这套芯片可以实现成本下降。《》此前就有报道,Anthropic 已经和微软开展长达数月的沟通,探讨后续使用 Maia 芯片的相关事宜。 📅纳德拉在 6 月对外表示,已经有两座数据中心在使用 Maia 200,公司计划把这套芯片推广到更多数据中心,其中包含部分海外站点。但知情人士透露,截止到上月末,微软依旧只在美国境内的两座数据中心部署 Maia 200。 🛡️就算微软没办法为 Maia 300 拿下外部大客户,公司也准备了备选方案:把更多内部 AI 业务迁移至 Maia 平台,同时继续向 Azure 云客户售卖价格高昂的英伟达芯片。微软内部测算,运行 OpenAI 以及微软自研模型的时候,Maia 200 对比尖端英伟达芯片,运营成本可以降低 30%‑40%。知情人士表示,专门针对自有模型做优化的 Maia 300,实际性能表现还会更进一步。 📈微软对 Maia 300 的意向采购规模,依旧不及谷歌、亚马逊等竞品公司的年度芯片采购体量。对比来看,根据行业测算,谷歌今年计划生产超过 300 万颗 TPU 芯片,明年产量会达到 500 万颗。 🔎与此同时,微软另外一条芯片产品线也取得不错进展,也就是自研 Cobalt 中央处理器。和 Maia 这类对标英伟达图形处理器的 AI 专用芯片不一样,CPU 属于更加传统的处理器品类,当下 CPU 的市场需求同样处在上行阶段。微软上周对外披露,OpenAI、Adobe 以及其他大型公司客户,已经在全球超过 25 座数据中心使用 Cobalt 处理器。 📜纳德拉近年私下多次批评英伟达在 AI 芯片市场的垄断地位。2022 年一封后续在法庭公开的邮件当中,纳德拉感慨,微软仅仅是英伟达上层很薄的一层,OpenAI 相关业务内部某个未具名部门,次年将会产生 4 亿美元亏损。 🧾目前暂不清楚具体是哪个业务单元产生亏损,知情人士表示,纳德拉所指的,是 Azure 运行 OpenAI 模型带来的高昂成本。一部分原因在于,微软没办法掌控芯片成本,同时也无法掌控 AI 模型本身的成本。自研 AI 芯片,就是微软为解决这两大痛点推进的举措。

总体总结

主题正文

  1. 🤔尽管当前一代微软自研芯片 Maia 200 落地推进节奏缓慢,知情人士透露,微软计划在今年秋季,最早可能在下个月,公开发布全新 Maia 300 芯片。
  2. 另有知情人士表示,这家云计算巨头已经和台积电开展洽谈,计划锁定超过 30 万颗芯片的制造产能,2027 年完成交付,该规模相比微软至今已经产出的数万颗 Maia 200 芯片提升一个数量级。
  3. 📑知情人士称,微软的终极目标是拿到超过 100 万颗 Maia 300 芯片的产能,但零部件供应约束、和台积电之间正在推进的产能谈判,会对该目标形成制约。
  4. 此前相关推进工作遭遇阻碍,Maia 200 芯片早期测试没有达成内部目标,发布时间因此推迟至去年,发布之后,该芯片也仅在微软少数数据中心内部投入使用。
  5. 🤞微软有信心争取更多客户选用即将推出的 Maia 300 芯片,Anthropic 会是潜在客户,核心原因是这套芯片可以实现成本下降。
  6. 📅纳德拉在 6 月对外表示,已经有两座数据中心在使用 Maia 200,公司计划把这套芯片推广到更多数据中心,其中包含部分海外站点。
  7. 🛡️就算微软没办法为 Maia 300 拿下外部大客户,公司也准备了备选方案:把更多内部 AI 业务迁移至 Maia 平台,同时继续向 Azure 云客户售卖价格高昂的英伟达芯片。
  8. 2022 年一封后续在法庭公开的邮件当中,纳德拉感慨,微软仅仅是英伟达上层很薄的一层,OpenAI 相关业务内部某个未具名部门,次年将会产生 4 亿美元亏损。