单卡5090跑满血DeepSeek V4Flash,已开源,Token自由了!
单卡5090跑满血DeepSeek V4Flash,已开源,Token自由了!本周五,AI 社区热烈讨论的是一个端侧大模型部署技术,它能让笔记本 RTX 4060 跑 Qwen 3.6-35B,桌面 RTX 5090 跑得起 DeepSeek-V4-Flash 284B。而且都是单卡,模型都是满血的。Codex 生产 trace 的中位 decode 速度是 33 token/s
搜索
本周五,AI 社区热烈讨论的是一个端侧大模型部署技术,它能让笔记本 RTX 4060 跑 Qwen 3.6-35B,桌面 RTX 5090 跑得起 DeepSeek-V4-Flash 284B。而且都是单卡,模型都是满血的。Codex 生产 trace 的中位 decode 速度是 33 token/s
深圳全域智能科技有限公司(以下简称全域智能)近日完成种子+轮融资。本轮融资由招商局创投领投,深担创投、三七互娱跟投,以及老股东同学村创投继续加注。这笔钱只有一个去处:训练脑机接口基座大模型。
对大模型祛魅、 谈真实落地的时代到了。
近期,字节跳动大模型核心部门Seed完成新一轮组织调整,调整核心集中在Seed Foundation Model(Seed基础模型)板块,新设四个一级部门,重构了预训练数据、强化学习与后训练的组织链路。
《读佳》获知,阿里旗下的虎鲸文娱集团已自研完成“虎鲸AI大模型”,并且正在内测一款全新的AI视频内容创作工具“虎鲸AI”,该工具部分功能需要充值才能使用,整个项目的研发测试或至少有半年以上。
外挂补不了模型智商,《苦涩的教训》再次上演。
长期依赖外部模型,不是最好的选择。
Scaling Law还在,但今天的大模型,已经不能只靠“参数量”来理解Scaling了。
完了,AI圈出「毒王」了!
半年累计融资近60亿元。