Ornith-1.0发布:美国终于有了自己的前沿开源编程模型
🔥 关注LC智趣厅,不错过每一次技术浪潮 →
美国有了自己的开源前沿模型,而且一出手就对标Claude Fable 5。DeepReinforce AI于2026年6月发布的Ornith-1.0,是美国实验室首个达到前沿级别的开源编程模型,MIT协议,4个尺寸从9B到397B参数——全部可商用。

🔥 不是又一个”开源平替”,是真正的竞争力
过去两年,开源AI模型的故事几乎全由中国实验室书写:阿里的Qwen系列、智谱的GLM、月之暗面的Kimi——美国公司要么不开源(OpenAI),要么开而不强(Meta的Llama在某些基准上落后一代)。
“Ornith-1.0的意义不在于它比Claude Opus 4.7更强——它确实不是。意义在于:一家美国公司终于证明,开源和前沿不是矛盾词。你还是可以公开权重、MIT许可,同时做到SWE-Bench Pro 62%+。”
核心数据:Ornith-1.0在SWE-Bench Pro编程基准上获得61.8%,超过了GPT-5.5的58.6%。 它的自进化训练方法(Self-Scaffolding)让模型通过在真实代码库中解决问题来自动提升——不需要人类标注数据。
🔥 自进化:AI训练AI的工业化尝试
传统的AI对齐需要海量人工反馈。Ornith-1.0走了一条不同的路:让模型在沙箱里编程、测试、调试自己的输出,用编译器和测试用例作为”奖励信号”。
这个方法的妙处在于可规模化。人类的标注能力是有限的,但编译器和自动化测试可以跑无限次。DeepReinforce声称,Ornith-1.0的训练过程中,超过90%的质量提升来自自动化自我改进,而非人工标注。
“让AI模型通过写代码来学习写代码——这个想法的优雅之处在于:代码是唯一一个可以通过机器自动验证对错的创作领域。Ornith-1.0把这一点用到了极致。”
🔥 开源美国制造:华盛顿的意外盟友
Ornith-1.0发布的时间点很微妙。白宫正在收紧最强大AI模型的控制,Anthropic的Mythos被收回,OpenAI分阶段发布。而一个MIT协议的全开源模型,恰好来自美国。
特朗普的AI行政令可能不得不面对一个悖论:你怎样管制一个已经开源下载超过10万次的模型?开源与管控的冲突,Ornith-1.0是最新的试金石。
Ornith-1.0还附带了一个容易被忽略的重要特性:它全系列支持128K长上下文,这意味着你可以直接喂给它一个完整的代码仓库或技术文档让它理解,而不需要手动分块。在实测中,397B版本的Ornith-1.0能够在6万行代码的基础上精确定位bug并提出修复方案——这种”理解全局再动手”的能力,是以往只有闭源商业API才具备的。
DeepReinforce的团队规模只有不到50人——这本身就是一个反直觉的事实。与OpenAI数千人、Anthropic上千人的团队相比,这个小型实验室通过自动化训练方法做出了能对标巨头的产品,进一步证明了:AI研发的胜负手正在从”人多”转向”方法好”。
在开源AI的牌桌上,美国终于有了一个能打的选手在开源AI的牌桌上,美国终于有了一个能打的选手。Ornith-1.0不是最强的模型,但它是最自由的——MIT协议意味着任何人都可以商用、修改、重新分发。在AI管控日趋严格的时代,自由本身就是一种竞争力。
👇 关注LC智趣厅,星标不走丢,每天一篇AI深度解读
— END —
LC 智趣厅 · 科技与生活的交点
ihygg.cn
