By 小墨
2026年5月7日
46
342
腾讯混元颠覆AI训练新思路:用技能图谱让小模型逆袭大模型
在AI领域,有一个看似合理的直觉:给模型安排越多的训练任务,它就会越强大。然而腾讯混元团队的最新研究颠覆了这一认知——真正决定训练效果的并非任务数量,而是AI在执行这些任务时经历了多少种不同的场景和技能组合。
方法论:图谱驱动的训练轨迹多样性
腾讯混元团队提出了一种名为SkillSynth的创新方法,构建了一张规模庞大的“技能图谱”:包含82,073个场景节点、57,214条技能边,以及185,529个经过LLM验证的桥接关系。其中85.6%的节点连通在最大连通分量中,意味着绝大多数技能都能串联成完整的工作流程。这一图谱覆盖了编码、文档处理、DevOps、安全等常见领域,并持续向音频语音、3D仿真、IoT硬件等长尾领域扩展。
采样策略与自动任务生成
SkillSynth的核心思路是将AI操作终端的过程抽象为“场景-技能”序列。其中,“场景”代表AI在某个决策点面临的状态(如“视频文件已下载但未压缩”),而“技能”则是AI在该状态下执行的一组动作(如“用ffmpeg压缩视频”)。每个技能从“前置场景”指向“后置场景”,形成有向图结构,图中的一条路径就对应一个真实的多步骤工作流。
训练Agent的胜负手不在参数量,也不在任务数量,而在训练轨迹的多样性。
“腾讯混元团队”采样策略的关键创新
在采样环节,团队采用了逆频率加权策略——被访问较少的节点和边会被优先选中,从而避免路径扎堆在热门节点上,确保采样出的路径在“场景×技能“空间上实现均匀覆盖。采样出路径后,一个多Agent协作流程将抽象路径转化为具体的可执行任务:规划器将路径转化为结构化的子目标和预期输出,构造器生成完整任务实例(包含指令、文件系统快照、容器环境、验证脚本、参考解法),最后通过双重验证机制(执行验证+评分验证)确保任务质量。一次全自动运行从3,721条采样路径中产出3,560个通过验证的任务实例,验证通过率高达95.7%。
实验结果有力验证了方法的有效性:在权威终端Agent基准Terminal-Bench 2.0上,使用SkillSynth训练的Qwen3-32B(320亿参数)得分29.6%,直接超越了参数量是其15倍的Qwen3 Coder 480B(23.9%)。对比实验显示,SkillSynth比单技能基线高出8.4分,比随机组合多技能基线高出3.0分。多样性指标更直观:SkillSynth轨迹的唯一“场景-技能“覆盖率比单技能高31%,比随机多技能高19%。消融实验还揭示了一个重要发现——随机拼凑多个技能(不经过图谱引导)效果明显更差,因为随机组合缺乏工作流连贯性。
如有侵权,请联系删除。
Related Articles
-
Fri May 15 2026滴普科技 X 上船院的AI智能体项目获“2026 IDC中国工业AI领航者”大奖
在IDC中国CIO峰会-深圳站上,上海船舶研究设计院与滴普科技联合打造的基于生成式AI的船型方案智能生成平台获得了“2026 IDC中国工业AI领航者”大奖,成为工业AI智能体应用的示范案例。
-
Fri May 15 2026【5.15-5.18 西安】高校教师AI智能体赋能教学创新全链路应用工作坊(第三期)
卓越国培组织的高校教师AI智能体赋能工作坊面向教育一线教师,强调零代码上手与教学全流程的AI应用,推动教育数字化与教学方法革新。
-
Fri May 15 2026AI行业观察:竞争格局动态演化,板块上行继续
2026年上半年,AI领域的竞争焦点明显向企业服务与落地部署倾斜。头部厂商频繁通过成立专门实体、对外并购与引入大额资本,强化面向企业客户的交付能力与服务链条。
-
Fri May 15 20262026新政解读:智能体与AI终端的'双向奔赴',AIoT产业迎来三大价值重构
2026年5月,相关部委发布的政策与标准信号明确:国家正在把智能体与AI终端纳入顶层治理与产业发展规划,旨在引导技术可控、安全与行业协同。
-
Fri May 15 2026上海交通大学最新Science论文:AI for Science再获突破
上海交通大学研究团队在Science期刊发表了一项重要成果,提出了一个由四个智能体组成的AI框架,专注于设计高效且稳定的钙钛矿太阳能电池材料与器件结构。
-
Fri May 15 2026葆德科技AI智能体隆重发布!
2026年5月15日,葆德科技在佛山市新质生产力大会上发布了面向工业全生命周期的“葆德科技AI智能体”。该智能体将设备选型、控制、节能与运维整合为一体,旨在为制造企业提供从采购到运维的端到端智能化支持
-
Thu May 14 2026从GraphRAG到本体演化:郑岩携手业界专家,打造Agent智能落地的知识工程实战
在 Agentic AI Summit 2026 的背景下,文章介绍了郑岩与业界专家围绕面向智能体的知识工程实践展开的讨论,重点关注如何让智能体在行业场景中具备更高的专业性与可解释性。
-
Thu May 14 20265.16 AI引领·资本赋能投融资对接会
5月16日的投融资对接会旨在搭建初创企业与资本方的高效沟通平台,聚焦具身智能、AI终端与大模型应用等领域的技术驱动型项目。
-
Thu May 14 2026腾讯季报图解:营收1965亿 马化腾称AI取得突破 市值却创一年新低
腾讯在2026年第一季度实现营收1965亿元,同比增长显著;公司在财报发布时同时强调对AI的持续投入与技术迭代,指出AI已在若干核心业务中取得阶段性进展。
-
Thu May 14 20265.13联发科'全域芯智能'发布会全面Ai生态化,包括:AI生态数据,AI智能体化引擎2.0,AI开发套件3.0,全星光影10亿三角面渲染。
2026年5月13日,联发科在上海举办天玑开发者大会(MDDC 2026),以“全域芯智能,体验新无界”为主题,正式推出其面向生态的AI解决方案与工具链。
-
Thu May 14 2026TikTok在美国和日本推出TikTok GO;苹果探索App Store引入AI智能体;熵约智能完成数百万美元天使轮融资
近期多条涉足消费与平台生态的AI与商业化新闻集中爆发,既体现大型平台的全球化产品扩展,也反映终端与具身智能创业公司的融资与产品迭代。
-
Thu May 14 2026143亿元,AI制药刚刚拿到了最大一笔融资
谷歌母公司Alphabet旗下的Isomorphic Labs完成了创纪录的B轮融资,本轮融资约为21亿美元(合计人民币143亿元),为AI驱动的药物研发注入重要资本。
-
Thu May 14 2026从一人公司到无人公司!智谱AI创始人唐杰:2026年突破焦点是长时程Agent
智谱AI创始人唐杰在近期访谈中强调,未来突破的核心为长时程任务能力与基于此的自主Agent系统,这一方向将决定智能体能否在复杂、长周期场景中持续执行并自我优化。
-
Thu May 14 2026营收1964亿、研发225亿,腾讯All in AI成效全面爆发
腾讯发布2026年Q1财报,营收1964.58亿元,研发投入225亿元,显示公司在AI领域的持续大手笔投入与商业化成效。
-
Thu May 14 2026腾讯阿里AI投入增加
2026年第一季度财报显示,腾讯和阿里均在AI研发与生态建设上加大投入,这些资金正逐步向云服务、行业解决方案与基础模型能力倾斜。
-
Thu May 14 2026Create 2026百度AI开发者大会:万物一体,智能体时代正式到来!
2026年5月13-14日,百度在北京举办Create 2026 AI开发者大会,主题为“万物一体”。大会提出将关注点从传统的日活用户(DAU)转向日活智能体(DAA),并展示了面向不同场景的智能体产
-
Thu May 14 2026AI顶尖论文体量反超美国,中国AI原创能力突破?
ICLR 2026的统计结果显示,中国大陆机构贡献了43.7%的录用论文,在总体数量上首次超越美国,这一现象引发对中国AI研究质量与原创能力的广泛讨论。
-
Wed May 13 2026AI原生办公智能体应用爆发,PC端重构Agent时代生产力范式
易观报告指出,2026年办公场景中的 AI 智能体能力正从简单对话交互向完整行动与结果交付演进,PC 端凭借其算力与完整数字环境成为承载复杂办公任务闭环的首选平台。
