7名博士生仅用3个月从零训练7B大模型:代码+数据+训练日志全公开
7名博士生仅用3个月从零训练7B大模型:代码+数据+训练日志全公开北京中关村学院7名博士生,用一个暑假,从零训练出了一个7B大模型——ZGCM-1。
来自主题: AI资讯
9094 点击 2026-09-15 10:16
搜索
北京中关村学院7名博士生,用一个暑假,从零训练出了一个7B大模型——ZGCM-1。
第一篇AI4AI综述论文将long horizon智能体、AI4AI与recursive self-improvement纳入同一研究地图,指出AI能在明确目标与评价规则下承担部分研发工作,但单项能力提升无法证明完整流程可靠,持续自我改进仍面临组合鸿沟等验证挑战。
Salesforce AI与UIUC研究人员提出Strong-to-Weak Scaffolding方法,让强模型(Builder AI)为弱模型GPT-5.4-mini自动设计外部Harness工作框架,无需修改参数即可将其在心智理论任务上的平均准确率从0.488提升至最佳0.912,揭示AI4AI的核心机制是将认知结构而非知识从强模型迁移至弱模型。
AI 能否改进 AI 自己?
刚读了一篇 AI4AI 论文《AI4AI at Scale》,来自 XYZ Agentic Team。还是第一次听到这个 Lab。他们用 AI4AI 的方式做出了两个很强的搜索 agent,也公开了方法。借这篇 paper 讲讲 AI4AI 到底怎么工作,下面尽量少堆术语。
尽管人工智能(AI)在飞速发展,当前 AI 开发仍严重依赖人类专家大量的手动实验和反复的调参迭代,过程费时费力。