1分钱9张图!DeepSeek视觉模型连夜实测
1分钱9张图!DeepSeek视觉模型连夜实测等了四个月,DeepSeek的多模态模型:deepseek-v4-flash-vision-exp,终于发布。我也是第一时间赶到现场,连夜开始实测。相比V4 Flash最大的不同,就是支持原生支持图片输入了,但图片生成当然还是没有的。
搜索
等了四个月,DeepSeek的多模态模型:deepseek-v4-flash-vision-exp,终于发布。我也是第一时间赶到现场,连夜开始实测。相比V4 Flash最大的不同,就是支持原生支持图片输入了,但图片生成当然还是没有的。
看到形界智能「Era」系列的原生模型Rise正式发布了,用500ms的端到端响应延迟,让人机交互,有了新的变量。第一时间测试了一下,给大家介绍介绍。全域沉浸,一种全新的视频交互形态
这期节目的嘉宾黄东旭,就是Token Maxing热潮的亲历者。他曾经只用最前沿的模型,每天账单三四百美元。让他转变的,是前沿模型的智力碾压和中国开源模型们的崛起——Fable 5可以一句话终结Agent群的讨论,同时大量的日常任务可以做到“只烧电费,不烧Token”。他的结论是:不是前沿模型用不起,而是本地开源模型底座+前沿模型的搭配,成本可控,更具性价比。
商汤科技这次正式开源的SenseNova U1.5 Lite,其亮点如下:而且啊,SenseNova U1.5 Lite依旧保持了8B的大小,还能在复杂排版与精准编辑等核心的场景上比肩闭源的GPT-Image-2:
位于北京海淀的互联网金融中心,任利锋创办的“数美万物”在这里有3个办公地点。其中的一间不是办公室而是实验室,他们采购来市面上主流的3D打印机,在实验室桌面上次第排开,每天打印自研生成式3D模型生成的东西。经自研模型Hi3D生成的图纸打印出的实物有没有破面或其它瑕疵,又如何改进、修补,都在这间屋内见分晓。
据一位知情人士透露,Nvidia已就投资Mercor展开讨论。Mercor是一家数据标注服务商,协助这家芯片设计商开发其开源AI模型。此次投资将作为一轮估值200亿美元融资的组成部分。现有投资方General Catalyst已在洽谈领投本轮融资。
JiuwenBox 的定位,可以用一个比喻说清:给 AI 干活的临时房间。它和 WorkSwarm 是这么配合的:用户在 WorkSwarm 里发一个任务,Agent 负责把任务想清楚、拆成几步;每一步要跑的命令、要运行的代码、要碰的文件,统统送进 JiuwenBox 的沙箱去执行。Agent 负责 "出主意",沙箱负责 "安全地动手"。
今天上午,OpenRouter 没有举行发布会,也没有公布技术报告,只用一个忍者表情放出了一款代号为“Ox Alpha”的神秘模型。“Ox”在英文中正有“牛”的意思,于是,一场属于 AI 行业的“牛来”也开始了。
DeepSeek 终于「开眼」了。就在刚刚,DeepSeek 推出了一款面向 Agent 时代的多模态模型:deepseek-v4-flash-vision-exp。目前,该模型已经上线 DeepSeek API 平台上,用户可以通过设置 model='deepseek-v4-flash-vision-exp' 访问该模型。
OpenAI 可能正在测试一款新的 AI 图像模型。 这两天,多名海外用户发现,一个名为 luna-lisa-alpha 的神秘模型出现在 LMArena 测试平台中。从目前流出的测试结果来看,luna-lisa-alpha 重点提升了几个方向,包括人物一致性、图像真实感、文字生成能力,以及此前 GPT Image 系列一直存在的噪点问题。