快一点!再快一点!快到世界能实时生成|和生数科技张金涛聊:Vidu S1、推理加速、实时交互模型
快一点!再快一点!快到世界能实时生成|和生数科技张金涛聊:Vidu S1、推理加速、实时交互模型金涛今年 26 岁,还是清华在读博士。真正把他带进「推理加速」的,是一个很朴素的判断——当大家都默认 FlashAttention 已经把 Attention 算子做到极致时,他却发现:显卡上明明还有更快的计算单元没被用起来 ——「这么明显的收益,为什么没人做?」
搜索
金涛今年 26 岁,还是清华在读博士。真正把他带进「推理加速」的,是一个很朴素的判断——当大家都默认 FlashAttention 已经把 Attention 算子做到极致时,他却发现:显卡上明明还有更快的计算单元没被用起来 ——「这么明显的收益,为什么没人做?」
谷歌的前端功底有多深,不需要任何人来认证。
向ChatGPT问一个看起来挺简单的问题:“Lasha Talakhadze之前的奥运举重纪录是多少?”
如果你从去年就开始用 Gemini,那感觉就像看着自家兄弟慢慢得了阿尔茨海默症。按理说,一家公司发新模型,通常是来打脸这种调侃的。可就在刚刚,Google 一口气发了三个新模型之后,网友非但没收回这句话,反而笑得更大声了。多少有种他们都不看好你,可偏偏你最不争气的即视感。
IEEE最新刊发了一条挺反常识的新思路:大模型的内存焦虑,可能要靠U盘里的同款技术来缓解了。没错,就是NAND Flash。但现在,SanDisk和SK海力士正在推动一种新东西:High Bandwidth Flash(高带宽闪存),简称HBF。
全网等了快三个月!DeepSeek V4正式版,可能最早明日发布,最迟不过这几天。目前,一部分人已提前拿到了DeepSeek V4(GA)灰度测试的权限。一共有两个版本:DeepSeek V4 Flash,DeepSeek V4 Pro。
图片来源:Unsplash 在 ChatGPT 的发布将生成式人工智能带入主流市场三年多之后,OpenAI 正将其关注点从个人用户扩展到家庭。 OpenAI 正在旧金山招聘一名专职产品经理,负责在其产
刚刚,Agnes 升级了!
2026年下半场,AI Coding赛道最大的焦虑变了。
其实Omni Flash和Seedance 2.0还真不一样,Omni Flash的能力是编辑视频,对原有视频的极度控制,而非直接生成视频。先给朋友们看几个实测案例吧,你可能就会有更深的体感。