1、证券研究报告投资评级:看好(维持)核心观点相关报告海外大模型三重进化:推理筑基、行动落地与生态重构的竞速新格局。海外头部大模型企业已进入推理能力升级、场景落地与生态体系重构的竞速新阶段。Anthropic、OpenAl、Google、OpenClaw等厂商各有核心布局:或以企业工作流为核心,实现与Office生态的深度集成;或聚焦长程任务闭环,打造专业生产力助手;或提升推理基线,拓展音频创作新场景;亦或是完成个人智能体产品化落地。这些探索共同推动大模型从单纯能力输出,向实际任务执行、规模化生产力交付升级。国产大模型多维突围:开源筑基、效率制胜与Agent生态协同的落地新格局。国产大模型企业以开
2、源为基底,围绕效率优化与Agent生态协同实现多维突破,智谱、MiniMax、Kimi、阿里、字节跳动等企业各展所长,或推动开源模型向长程Agent工程化落地,或凭速度与成本撬动Agent规模化,或通过多模态MoE架构强化并行Agent执行,亦或是以开源旗舰升级+多端部署推动Agent商业化落地,同时完成模型能力补全与规模化分发链路搭建,全面发力Agent实际任务执行场景。行业趋势印证:从生成到行动,竞争聚焦供给效率与生态重构。大模型行业已完成从“生成到“行动的核心转向,任务复杂度与调用链路提升成为行业增长核心动力,Token消耗与任务ROI成为核心衡量指标。行业竞争焦点从模型参数、跑分转向低
3、单位推理成本、高吞吐、稳定工具调用的综合供给效率,同时工作台、Office集成等新入口取代传统对话框,入口控制与可执行生态的系统性构建成为关键,开源模型在真实流量中的占比也持续提升。投资建议:见正文。风险提示:技术迭代不及预期的风险;商业化落地不及预期的风险;政策支持不及预期风险;全球宏观经济风险。1海外大模型三重进化:推理筑基、行动落地与生态重构的竞速新格局1.1Anthropic:模型能力锚定企业工作流,工程师生产力成核心主线1)近期,Anthropic完成模型双版本迭代,主打1M上下文与长程Agent能力,实现旗舰与主力型号能力分层及规模化覆盖。其策略不再聚焦通用能力单点提升,转而以企业
4、真实工作流稳定交付为核心,系统推进两大方向:一是强化模型在编码、长程Agent、computeruse、知识工作等场景的技术可靠性;二是将能力封装为ClaudeCode、Cowork等可复用工作单元,嵌Excel、PowerPoint等Office工具,主攻企业市场与团队渗透,以工程师生产力为落地主线。1ClaudeOpus4.6:旗舰模型升级,首次解锁1M上下文,纳入办公生产力核心能力:2026年2月5日,Anthropic发布ClaudeOpus4.6,核心升级直指三大方向,即更强的编码能力(含代码审查与调试)、更严谨的任务规划能力、更持久的长程agentic任务执行能力,且在Opus旗舰
5、级别首次开放1Mtoken上下文窗口。同时,公司将办公生产力正式纳入旗舰模型能力边界,明确其可适配财务分析、行业研究、文档/表格/演示文稿的创建与编辑等企业高频场景,并能在ClaudeCowork场景中充分发挥多任务自主执行的优势,实现旗舰能力与企业工作流的深度融合。2ClaudeSonnet4.6:主力型号全面升级,强化规模化交付属性:2026年2月17日,Anthropic推出ClaudeSonnet4.6,定位为面向更大规模用户的主力型号升级,官方强调其在coding(编码)、computeruse(计算机使用)、长上下文推理、agentplanning(智能体规划)、知识工作与设计等核
6、心维度实现全面能力提升,且同步开放1Mtoken上下文窗口。(divcenter)图1:Opus4.6在深度、多轮agent任务中排名第一(/divcenter)2)能力向工作流产品落地:ClaudeCode/Cowork做厚代理入口,打造可调度团队级劳动力Anthropic跳出对话框调用模型的基础形态,将模型能力深度融入企业工作流,核心产品形成差异化竞争与场景覆盖。ClaudeCode直接切入开发者工作流核心环节,在Al编码工具赛道建立强势市场地位,路透社在报道OpenAl推出Codex桌面应用时,明确指出其推出系应对ClaudeCode的竞争优势,且ClaudeCode上线后短期即实现约1