1、 本报告版权属于国证国际证券(香港)有限公司,各项声明请参见报告尾页 大模型大模型密集密集更新,更新,调用量维持强劲,调用量维持强劲,支撑支撑 AI 投资逻辑投资逻辑 我们观察到最近两周国内外大模型密集发布新模型,我们观察到最近两周国内外大模型密集发布新模型,在模型效率优化和技术迭代在模型效率优化和技术迭代上均有明显提升,同时大模型调用量维持强劲增长趋势上均有明显提升,同时大模型调用量维持强劲增长趋势。我们认为由大模型驱动我们认为由大模型驱动的业务仍是投资主线,的业务仍是投资主线,具备具备短期催化剂短期催化剂+长期商业化长期商业化潜力潜力的特征的特征,建议持续关注。建议持续关注。报告报告摘要摘
2、要 模型调用量模型调用量维持强劲增长趋势:维持强劲增长趋势:据 Open Router 数据,9 月 17 日-30 日的两周内,xAI 的模型 token 日均调用量为 2,620 亿,位列第一,主要因 Grok Code Fast 1 的极致性价比价格(百万 tokens 输入/输出价格仅为 0.2 美元/1.5 美元)。Alphabet Gemini系列模型的日均调用量为 1,320 亿,OpenAI 为 820 亿,分别位列第二、三。中国大模型方面,DeepSeek 日均调用量为 750 亿,阿里 Qwen 为 260 亿,保持平稳。全球大模型调用量总体维持强劲增长(图表 1)。阿里巴
3、巴:阿里巴巴:9 月 24 日发布多款新模型:1)旗舰模型 Qwen3-Max,总参数超万亿;2)Qwen3-VL(视觉语言处理)thinking 版本多模态推理 SOTA 水平。3)升级 Qwen3 Coder,编码效率提升。此外,通义千问系列模型下载量已超 6 亿,衍生模型规模超 17 万(全球领先)。快手:快手:9 月 26 日,发布可灵 2.5 Turbo 模型,视频生成的可控性&稳定性&一致性提升,同时定价下调 30%。10 月 2 日,Artificial Intelligence 更新视频生成模型基准测试,可灵 2.5 Turbo 在文生视频和图生视频均位列第一,处于 SOTA
4、水平。DeepSeek:9 月 29 日,发布 DeepSeek-V3.2-Exp 模型(实验版本),引入稀疏注意力机制,提升长文本训练和推理效率。同时下调 API 价格,百万 tokens 输出价格为 3 元,较 DeepSeek V3.1 Terminus 降 85%(基于 Artificial Intelligence 数据)。同时,该模型的开源算子包含 TileLang、CUDA 两个版本,TileLang 为面向 GPU 算子开发的国产编程语言,由北京大学计算机学院主导开发并于 2025 年 1 月开源。DeepSeek 当前的模型迭代方向已展项出适配国产算力芯片的趋势,利好国产芯片
5、硬件与软件生态闭环。OpenAI:10 月 1 日,OpenAI 发布新一代视频生成模型 Sora 2,首次实现对现实世界物理规律的精准模拟,并可同步生成环境音效,OpenAI 认为是视频生成领域的“GPT-3.5 时刻”。同时,宣布推出名为 Sora 的社交软件,iOS 版已在美国&加拿大上线,基于 Sora2 的 AI 原生视频社交,功能类似 AI 版 TikTok。Sora2 及 Sora App 目前仍在邀请制内测阶段。此外,据 Information 报道,OpenAI 在 2025 年上半年实现收入 43 亿美元,较 2024 年全年高 16%,净亏损 135 亿美元。目前估值约
6、5,000亿美元,较 2025 年 4 月(3,000 亿美元)提升 67%。OpenAI 将于 10 月 6 日举行2025 OpenAI DevDay 开发者日,预计将有大模型相关更新发布。Anthropic:9 月 29 日,发布 Claude Sonnet 4.5 模型,性能较上代优化,SWE-bench Verified(软件编码)基准测试中,准确率为 77.2%,为行业领先。可实现长达 30小时的连续任务处理。此外,定价与 Sonnet 4 一致,百万 tokens 输入/输出价格为3 美元/15 美元。9 月完成 F 轮融资后,Anthropic 估值达 1,830 亿美元。投资