AI for Data🔥7.0

Ai2 发布 Olmo-core 3,让大规模混合专家大模型的开发更高效

原标题: Ai2 发布 Olmo-core 3,让大规模混合专家大模型的开发更高效

SiliconANGLE·2026/10/2 16:15:44🔗 原文

📋总体概括

西雅图非营利研究机构艾伦人工智能研究所(Ai2)发布大模型开发框架 Olmo-core 3,重点优化混合专家(MoE)架构大模型的训练流程。该框架支持将 MoE 模型训练扩展至万亿参数规模,同时保持计算效率、控制训练成本。MoE 与稠密模型运作机制不同,仅激活部分专家参数即可完成计算,借此在扩大总参数量的同时避免算力开销线性膨胀。作为以开源开放著称的研究机构,Ai2 此次升级延续其 OLMo 系列开放路线,为学界与中小企业提供低成本训练超大规模模型的工程基础。

⚡关键信息

  • ▸Ai2 周四发布大模型开发框架 Olmo-core 3,聚焦混合专家(MoE)架构训练优化
  • ▸框架支持 MoE 训练扩展至万亿参数规模,同时维持计算效率、压低训练成本
  • ▸MoE 与稠密模型机制不同,通过只激活部分专家参数来控制算力开销
  • ▸Ai2 是位于西雅图的开放研究机构,Olmo-core 3 延续 OLMo 系列开源路线

🔥犀利点评

万亿参数训练框架本身不稀奇,稀奇的是出自一家非营利机构之手,且大概率开源。头部实验室的训练栈早已封闭成护城河,Ai2 的价值就在于把「如何训大模型」的工程细节摊开给所有人看。当然,框架开源和真训得起万亿 MoE 是两回事,算力账单最终仍会筛掉绝大多数跟风者——但至少门槛从「秘方」降到了「钱」,这是实打实的进步。

本文由本站自动聚合,以下为原始来源:前往 SiliconANGLE 阅读全文 →