2000+真实场景搬进仿真!一个导航模型零样本“通吃”四种机器人本体
2000+真实场景搬进仿真!一个导航模型零样本“通吃”四种机器人本体过去一年,具身智能的技术迭代明显加快。VLA、世界模型持续演进,强化学习重新成为机器人学习的重要技术路径,Sim2Real加速从仿真走向真机,全身控制能力也在快速突破。
搜索
过去一年,具身智能的技术迭代明显加快。VLA、世界模型持续演进,强化学习重新成为机器人学习的重要技术路径,Sim2Real加速从仿真走向真机,全身控制能力也在快速突破。
如今的 AI 已经能顺畅地帮你写代码、跑实验、做评估。算法工程师的每一天,几乎变成了:让 LLM 整理昨天的实验结果,让 LLM 实现新想法,让 LLM 监控实验运行…… 似乎只需把需求告诉 AI,它就能完成大部分算法工作。
Anthropic CEO Dario Amodei发表长文呼吁控制前沿AI能力提升节奏并引入嵌入式第三方安全评估机制,OpenAI CEO Altman随即表态支持,并以AI安全为由确认OpenAI今年不会进行IPO。
Genspark 发布基于 MiniMax M3 后训练的自有品牌 PPT 模型 Gen-1 Slides,标志着这家曾被比作"AI Costco"的应用公司开始从组合外部模型转向在开源基座上训练专用模型。
分析机构SemiAnalysis点名谷歌Gemini 3.8 Flash和Meta Muse Spark 1.3在Terminal-Bench 2.1刷榜,换用新版Terminal-Bench 4.0后Gemini分数从89.4暴跌至19.1,揭露大厂通过购买"模拟卷"训练数据刷榜的AI造假黑幕。
OpenAI Codex团队主张模型越强Harness应越轻量,Anthropic Claude Code团队则认为模型越强Harness反而需越复杂以支撑Agent长时间自主运行,两者共同揭示了Agent Harness正经历从辅助层向承重结构转变的结构性变化。
Shengtao Guo、Ethan X. Fang和Junwei Lu署名的预印本论文宣称利用Odin Automatic AI Research Agent证明了悬而未决40年的Komlós猜想并给出常数界3√(2π),次日陶哲轩等25位菲尔兹奖得主发表联合声明《AI在数学中的严重失准》,警告AI证明速度已远超学界验证与消化的能力。
Anthropic CEO Dario Amodei发文呼吁为前沿AI限速并提出驻场评估、国家与全球协同三步方案,获OpenAI CEO奥特曼和马斯克罕见力挺,同时承认全球限速最终离不开与中国协调。
OpenAI宣布旗下史上最快模型GPT-5.3-Codex-Spark仅存活7个月后将于下周退役,因其"以智能换速度"的设计在Cerebras晶圆上跑通旗舰模型GPT-5.6 Sol的Ultrafast模式后已失去存在意义。
OpenAI发布Agents API,将Codex背后的Harness能力拆解为云端托管服务对外开放,开发者只需指定任务、模型、工具和运行环境即可创建Agent,标志着Codex从单一产品升级为可复用的平台。