从Chat、Code到Discovery,AI开始学着做科学家
从Chat、Code到Discovery,AI开始学着做科学家成立才一个多月,估值就要冲到 500 亿美元。
搜索
成立才一个多月,估值就要冲到 500 亿美元。
Claude Code 里,已经有人玩起了俄罗斯方块。不是另外打开一个游戏窗口,游戏直接出现在 Claude Code 的界面里。
Claude Opus 5.2深夜在Claude Code中开启灰度测试悄然上线,开发者通过抓包确认前端未变的Opus 5已被路由至5.2版本,响应速度和自主迭代能力显著提升;同时Anthropic内部代号Model 2的模型在CoBench v2榜单取得62.8%高分并接管大部分代码编写工作,RSI进程疑似加速。
最近一周,我们被一件事惊到了。
AgnesCode在部分芯片上跑出更高性能,免费模型完成专业级交付。
OpenAI Codex团队主张模型越强Harness应越轻量,Anthropic Claude Code团队则认为模型越强Harness反而需越复杂以支撑Agent长时间自主运行,两者共同揭示了Agent Harness正经历从辅助层向承重结构转变的结构性变化。
OpenAI宣布旗下史上最快模型GPT-5.3-Codex-Spark仅存活7个月后将于下周退役,因其"以智能换速度"的设计在Cerebras晶圆上跑通旗舰模型GPT-5.6 Sol的Ultrafast模式后已失去存在意义。
OpenAI发布Agents API,将Codex背后的Harness能力拆解为云端托管服务对外开放,开发者只需指定任务、模型、工具和运行环境即可创建Agent,标志着Codex从单一产品升级为可复用的平台。
GPT-6爆火的人体解剖3D案例被扒出实际调用了现成3D数据集素材而非真正生成,文章作者通过GPT-6搭配Hyper3D MCP,用Codex调用Hyper3D Rodin模型实际复刻出可交互的3D人体拆解网页,并延伸制作了可拆装蒸汽甲壳虫、橘猫子弹时间、骑楼街景和影子解谜游戏等多种3D交互作品。
Kimi K2.8 Preview 编程模型全量上线 Kimi Code,支持 1M 超长上下文并向所有会员档位开放,综合性能接近 K3,默认采用 Max 思考档位,编码和智能体能力较 K2.7 Code 有所提升。