视频DiT直接「长」出 4D 世界!浙大仅用1K条数据打通统一接口
视频DiT直接「长」出 4D 世界!浙大仅用1K条数据打通统一接口今天的视频生成模型,已经越来越像一个会拍电影的导演。
搜索
今天的视频生成模型,已经越来越像一个会拍电影的导演。
一个需求从零推到能开发,我得写调研问卷、拆竞品、出原型、写 PRD,就是给研发看的那份需求说明书,然后拉上研发测试设计法务开评审会,最后再补一份埋点方案,说清楚上线之后用户每个动作要记哪些数据。
Claude Code的增长神话,破灭了!
四足卖了近亿元后,维他动力杀入人形。
具身智能下一阶段,究竟还应不应该继续”堆数据”?
大模型机制可解释性研究中,一直存在一个颇具反差的现实: 为了理解一个已经训练好的模型,研究者往往需要先训练一套新的稀疏表示。
一批纸质书被买下,送进仓库。
就在刚刚,SemiAnalysis的一个内部播客,曝出了不少猛料。据悉,Anthropic新模型Mythos 2已经训练完成,但惨遭雪藏。现在,Anthropic正用Mythos 2生成的数据,去全力冲刺Mythos 3!
机器人走出实验室后,训练数据不再只是 “多不多” 的问题:环境能否覆盖真实世界的尺度、遮挡、接触和运动,直接决定策略能否落地。Real2Sim 因此重新受到关注 —— 如果普通视频也能变成可交互的仿真场景,采集成本会比人工建模或专用设备低得多。
过去几年,大模型的发展主线很清晰,比如更大的模型、更多的数据,以及更多的计算。但当模型从回答问题的Chatbot走向能够调用工具、执行任务的Agent,发展主线也开始发生变化。模型不仅要知道,还要在环境中行动,从反馈中判断结果,并在长时间运行中不断调整策略。