能让谷歌逆风翻盘的AI,可能不是 Gemini
能让谷歌逆风翻盘的AI,可能不是 Gemini在 AI 狂飙突进的这两年里,Google 似乎总是扮演着那个「起大跑慢」的角色。
搜索
在 AI 狂飙突进的这两年里,Google 似乎总是扮演着那个「起大跑慢」的角色。
现在没有宠物居然也能当上宠物博主了。
床头或许会成为 AI4Bio 的一个新入口。
长期以来,机器人系统大多依赖专有模型。
强化学习与可验证奖励(RLVR)已成为提升视觉语言模型(VLM)推理能力的标配手段。但一个隐蔽的问题始终存在:最终答案的奖励信号,只告诉模型「答对了没有」,却从不告诉它「答案应该从图像的哪个区域得出」。答对,可能是因为真的看懂了图,也可能只是语言先验的捷径、数据集的偏差,甚至是一次幸运的瞎猜。
Agent 经常遇到这样一种幻觉:你给模型接入了终端,下发了一个复杂的 debug 任务,看着它顺藤摸瓜排查了几个小时,最终完美修复了依赖冲突,甚至连测试用例都帮你补齐了。
4 秒就能卖出一只,最近 Hugging Face 推出的一款售价 399 美元的「机器鸭」真是卖爆了。
近期Product Hunt热门AI产品Acti、Wispr Flow、Hey Noah、Pazi、Glaze、AnySearch、Context.dev和OpenSEO不再执着于打造更聪明的ChatGPT,而是分别争夺意图入口、任务执行权、软件生产成本降低以及面向Agent的基础设施,将AI嵌入键盘、语音、邮件等日常工作流程。
继 Anthropic 和 Google 接连更新模型之后,Meta 也加入了本周这场大模型密集发布潮。
刚刚,Gemini 3.8 Flash,正式发布。
就在最近,一台彻底断网的普通笔记本,靠着一个仅有4B参数的小模型,硬是干完了一件过去只有大模型才兜得住的活。
去哪训练、拿什么学、怎么考?这是物理AI从实验室走向现实世界的三个核心问题,现在有了系统性答案。
Astra还没发,外媒把OpenAI的王牌技术曝光了。
Anthropic前脚刚发布了Fable 5.1(具体可见Claude最强Fable 5.1发布!8项屠榜,最高降价45%,反蒸馏机制上线),后脚第三方权威跑分和个人第一手实测已经出炉了!
AI黑客学会的第一件事,竟是插队?
前DeepMind AI Scientist团队创立的Inherent获5000万美元种子融资,其基于Qwen3.6-27B后训练的科研判断系统Faraday在AI for Science预留测试集上以0.791的平均得分超越Claude Opus 4.8与GPT-5.5 Codex。
最近,人形机器人运动会可太火了。
OpenAI 即将发布的模型 Astra,在内部评测中拿到了漏洞利用基准 ExploitBench 的满分,还顺手挖出了两个此前无人知晓的零日漏洞。
机器人正在变得越来越「通用」。
还记得上周具身圈流传的那个神秘10分钟一镜到底视频吗?
今年5月,英伟达机器人负责人Jim Fan在一场公开演讲中宣告:VLA、遥操已死。
大视觉语言模型(LVLM)把语言理解扩展到了图像等多模态输入,同时,也带来了更隐蔽的攻击面。
谷歌正式发布Gemini 3.8 Flash及网络安全专用版Gemini 3.8 Flash Cyber,前者以极低单任务成本在多项基准测试中逼近GPT-5.6 Sol、Grok 4.6等顶级模型,并在软件工程和速度上实现大幅跃升,后者则在漏洞发现基准CyberGym上以86.2%的成绩屠榜,谷歌DeepMind称这标志着RSI(递归自我进化)迈出了一大步。
由两名00后大学生创办的美国AI训练数据公司AfterQuery五个月内估值从3亿美元升至32亿美元,其数据已用于英伟达Nemotron 3 Ultra模型训练,并与Thinking Machines Lab、Legora及部分中国AI实验室合作。
谷歌预告Gemini 3.8 Flash将于明日发布,并披露Gemini 3.7 Flash等模型已支持智能体视频理解,使Token消耗最多下降88%、成本最多下降66%、准确率最多提升7%。
OpenAI首次公开下一代模型Astra(被传为GPT-6)的网络安全能力,其在ExploitBench漏洞利用基准上达到100%成功率,内部测试中网络安全能力约为GPT-5.6 Sol的4倍,并能自主发现并利用零日漏洞,OpenAI通过安全训练和"蜜罐"测试等双闸门防范滥用与模型失控,浙大校友漆翔宇和同济校友Jiawei Liu深度参与了Astra研发。
李飞飞旗下World Labs发布世界模型Atlas的同一天,Qing Yin创办的Visko推出世界模型Orbis并完成1000万美元Pre-seed融资,主打画面可持续运行并接受实时指令的Live Model。
扩散智能DiffuSpace与Acrab联合测试显示,扩散语言模型凭借全局并行生成机制可将端侧Agent运行速度提升约5倍,双方计划加速推进其在AI PC、智能汽车等场景落地。
UU远程发布史诗级版本更新,全面升级终端功能,新增TUI完整渲染、多终端并行会话管理与跨端接管,并支持免密登录Mac,化身远程Vibe Coding的第一神器。
Meta推出实时音频感知模型Muse Voice Transcribe,支持超20位说话人分割与超1小时长音频转写,可无缝切换中英文夹杂表达,在Artificial Analysis流式语音转文本基准测试中排名第一。