开源AI公司Nous Research周一甩出一款新编程模型NousCoder-14B,号称在多项基准上追平甚至超越更大规模的闭源系统。关键数字:只用48块英伟达最新B200显卡,训练时间四天。就问你服不服?
这时间点挑得太巧了。Anthropic的Claude Code从元旦起霸屏开发者社区,谷歌Gemini API首席工程师Jaana Dogan那条爆款推文说得直白:给Claude Code一段问题描述,它一小时生成了我们团队干了一年的分布式编排系统。这边厢闭源神器封神,那边厢开源阵营立刻拿出竞品——AI辅助编程这赛道,卷得比想象中快得多。
往好听了说,这是百花齐放;往坏了说,小公司再不搏命就要被大厂碾压成渣。NousCoder-14B在LiveCodeBench v6上拿到67.87%准确率,比基座模型阿里Qwen3-14B提升了7.08个百分点。数据不惊艳,但人家玩的是另一套逻辑:完整开源。
不是只放权重那种假开源。Nous Research把强化学习环境、基准测试集、训练框架Atropos全数公开,任何有算力的团队都能复现甚至改进。训练者Joe Li本人就是前竞赛程序员,这背景放在这,明摆着告诉你:我们这模型就是冲着奥林匹克级推理去的。
一个讽刺的现实:Claude Code靠演示视频征服人心,NousCoder靠透明度和可复制性抢地盘。大模型时代,能力重要,但怎么造出来的同样重要。开源阵营这步棋,走的是长期主义——让整个行业都能站在自己肩膀上。
四天训练,48块卡,14B参数。这数字组合放在今天的大模型军备竞赛里寒酸得可笑,但恰恰证明了一件事:堆算力不是唯一答案,方法对了,小模型也能咬下大模型一块肉。Claude Code们还在秀肌肉,Nous Research已经在教你怎么自己长肌肉了。
这场仗,才刚开始。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。