当硅谷还在执着于谁的模型参数更大的时候,中国最大的科技公司之一腾讯,给出了截然不同的答案。
7月6日,腾讯正式发布第三代旗舰大模型Hy3——一个参数量克制在2950亿参数、实际激活210亿参数的混合专家模型MoE。不是最大,但目标极其清晰:专为AI Agent场景和企业生产力工作流优化。

Hy3的战略定位很明确,不在基准测试上争第一,而是要在真实商业场景中真正用起来。这背后是中国AI行业独特的压力测试:高端AI芯片获取受限,使得国内厂商无法像美国公司那样靠堆算力来弥补架构效率的不足。
从实际数据看,Hy3在Agent任务上表现优异。在BrowseComp和MCP-Atlas测试集中,Hy3分别得分84.2和79.1,与Claude Opus 4.8和GPT-5.5等顶级闭源模型基本持平,幻觉率仅为5.4%,远低于Grok 4.5的54%。但在编程任务上,差距依然明显。

共生设计:腾讯的WorkBuddy、元宝、ima等内部产品,作为Hy3的真实测试场,每时每刻都在产生真实反馈,推动模型能力的持续改进。腾讯称,WorkBuddy内部任务成功率从72%提升至90%,平均执行时间减少34%。

一场关于效率的全球竞赛:Anthropic通过专注编程可靠性和长上下文推理,已悄然在企业API市场超越OpenAI——2026年份额约32%对25%,Claude Code年化收入已达25亿美元。两家公司从不同路径证明了同一个结论:AI的下一场竞赛,不在谁拥有最大的模型,而在谁能将AI深度嵌入真实工作流。
OpenClaw—AI研究