谷歌内测 Gemini 4「Carbon」:员工称代码能力直追 Claude Opus 5.5
10 月 9 日,Business Insider 援引内部文件与员工访谈报道,谷歌已将代号为「Carbon」的 Gemini 4 新检查点部署到内部编程平台 Jetski(与 Antigravity 相关联)供员工测试。一名参与测试的员工称,Carbon 的编程表现「堪比 Anthropic 的 Claude Opus 5.5」,另一名员工也给出正面评价,但前者同时强调还需要更多测试才能下结论。

发生了什么
10 月 9 日,Business Insider 援引内部文件与员工访谈报道,谷歌已将代号为「Carbon」的 Gemini 4 新检查点部署到内部编程平台 Jetski(与 Antigravity 相关联)供员工测试。一名参与测试的员工称,Carbon 的编程表现「堪比 Anthropic 的 Claude Opus 5.5」,另一名员工也给出正面评价,但前者同时强调还需要更多测试才能下结论。
关键事实
- 内部代号 Carbon:据报道是 Gemini 4 家族的一个新检查点,目前仅在内部平台 Jetski 上测试,尚未对外发布。
- 员工评价:有员工将其代码能力比作 Anthropic Claude Opus 5.5;另一位员工同样给出正面评价,但也指出需要更广泛的测试。
- 发布形态未定:Business Insider 称无法确认 Carbon 会成为 Argon 的更新版,还是以独立型号发布;谷歌也可能永不公开发布。谷歌对此拒绝置评,也未公布 Carbon 的任何基准成绩。
- 多版本并行:内部文件显示谷歌同时在评估 Argon、Barium、Carbon 多个代号版本;其中 Barium-B 据称被选为公开发布的 Argon。
- 背景:谷歌 9 月 30 日发布 Gemini 4 Argon,首批面向 Fairwind 计划的网络安全合作伙伴;员工此前反馈早期 Argon 版本在部分编程任务上落后于竞品。
为什么重要
测试员工称 Carbon 编程表现堪比 Claude Opus 5.5;早期 Argon 版本曾被员工反馈部分编程任务落后竞品,谷歌未公布 Carbon 基准成绩。
评论
今天
10月12日 星期一- 早报GSK 扩大与 Chai 合作:AI 设计通过湿实验室验证
共 9 条 · 10月11日
- 三问
- 预测
