OLMo
来自 Allen Institute for AI · allenai.org ↗
由 Ai2 推出的完全开放大语言模型系列,连同训练数据、代码与权重一并发布。
open-source llm research
- 分类
- 开放模型
- 商业模式
- 开放(开放权重/源码)
- 可用性
- 全球
- 发布
- 2024-02
- 记录更新
- 2026-07-30
- 模型系列
- OLMo
- 许可证
- Apache-2.0
- 成立时间
- 2014
- 总部所在地
- US
概述
OLMo 是艾伦人工智能研究所(Ai2)推出的完全开放大语言模型系列,连同完整的训练数据、代码、评测套件与权重一并发布。它为透明、可复现的研究而设计,OLMo 2 与 OLMo 3 等后续代款与同等规模的开放权重模型相当。一切均在 Apache 2.0 下免费。
主要功能
- 完全开放:权重、数据、代码与检查点
- 公开发布的 Dolma 训练语料
- 可复现的训练与评测流水线
- 允许商用的 Apache 2.0 许可
适用场景
- 面向 LLM 训练动力学的学术研究
- 对照已知训练数据审查模型行为
- 在透明且可商用的基座上构建
定价
OLMo 的模型、数据与代码在 Apache 2.0 下完全免费;用户仅承担自己的算力成本。
常见问题
OLMo 与其他开放模型有何不同?
OLMo 发布完整技术栈——训练数据、代码、日志与权重,而不仅是最终模型,从而实现真正的可复现性。
OLMo 由谁开发?
由艾伦人工智能研究所(Ai2)开发,这是位于西雅图的非营利研究机构。
OLMo 可商用吗?
可以,一切均以宽松的 Apache 2.0 许可发布。
同类产品
- Baichuan — 来自北京百川智能的开放权重中英双语大模型系列,现已聚焦医疗 AI,推出 Baichuan-M 系列推理模型。
- Command R — Cohere 面向检索增强生成(RAG)与工具调用优化的开放权重大模型系列;旗舰位置已由 Command A 接替。
- DBRX — Databricks 于 2024 年发布的开放权重混合专家(MoE)大模型;2025 年已从 Databricks 服务中退役,但权重仍可获取。
- DeepSeek — 来自杭州 DeepSeek 的开放权重大模型系列与聊天助手,以强大的推理模型著称。正式版 DeepSeek-V4-Flash-0731 API 通过后训练实现 Agent 能力大幅升级,原生支持 Responses API 并适配 Codex。
- Falcon — 由技术创新研究院(TII)开发的开放权重大语言模型系列。
- Gemma — 谷歌推出的轻量级开放权重模型系列,源自与 Gemini 相同的研究。
来源
本记录最近复核于 2026-07-30。
机器可读记录:/api/products/olmo.json · 发现错误?提交纠错