“堪比Opus 5.5。”这是谷歌内部员工给一个代号Carbon的模型打的评语,被拿来对标的,是Anthropic面向复杂代码和长时程智能体任务的那款旗舰。
Carbon属于Gemini 4家族。从流出的内部文档和截图看,它很可能是Argon架构上的一个新检查点,也就是在同一个模型基础上接着训出来的更新版本。它最近已经接进谷歌内部的代码平台Jetski,员工在上面实际写代码、跑任务。同一批反馈也给自己留了余地:这个结论还得经过更完整的评测才算数。内部员工的手感,和公开基准、第三方实测之间,往往差得不小。
拿前作对照,更能看出Carbon想补哪块短板。Argon早期版本在内部口碑不差,但碰上部分高难度编程任务还是吃力,员工估计大体相当于Claude Opus 5的水准。Opus 5之后Anthropic又推出了Opus 5.5,要是Carbon真能追到5.5,等于在写代码这条线上往前跨了一代。
名字的事别太当真。
谷歌的内部代号和最终对外名称经常对不上号。准备以Argon名义发布的那个模型,最早的内部代号其实是Barium-B。眼下内部同时在测的Gemini 4衍生模型,至少有Argon、Barium、Carbon几个。Carbon最后是作为Argon的后续微调版放出,还是单独成为一个新型号,现在没人说得准,谷歌也没有回应。
对开发者来说,更实际的是它会不会照Argon的路子走:先小范围给特定客户,再慢慢放开API。按这个节奏,普通人摸到Carbon恐怕还要等上一阵。
© 版权声明
文章版权归作者所有,未经允许请勿转载。






谷歌内部在测Gemini 4的Carbon版本,已接入代码平台Jetski,员工称能跟Opus 5.5掰手腕