码农之家

专注优质代码开发,为软件行业发展贡献力量

Agent 性价比战开打、国产大模型融资与寒武纪万亿市值

1. Anthropic 发布 Claude Sonnet 5:旗舰能力六成价格,Agent 商业化进入价格战

美东时间 6 月 30 日,Anthropic 正式发布新一代中端模型 Claude Sonnet 5,并将其设为 Claude 平台的默认模型,面向免费与付费用户全面开放。Anthropic 称其为公司迄今智能体能力最强的 Sonnet 模型,目标不是刷新榜单,而是把接近 Opus 4.8 的能力以更低成本送进企业工作流。

核心卖点有两组数字:在智能体任务上的表现已接近旗舰 Opus 4.8;API 定价在 8 月 31 日前的优惠期为 每百万输入 token 2 美元、输出 10 美元,相比 Opus 4.8 的 5 美元 / 25 美元便宜约 60%。优惠期结束后定价为 3 美元 / 15 美元,仍比旗舰便宜约四成。该模型可完成浏览网页、制定多步骤计划、编写与调试代码、调用企业工具等复杂任务。

值得关注:大模型竞争正从“谁的模型更聪明”转向“谁能以可接受的成本完成真实工作”。Sonnet 5 的定价策略意味着 Anthropic 想把 AI 智能体从实验项目变成企业预算里的常规开支。对企业来说,这可能是好消息:Agent 的落地门槛在降低;但对整个行业而言,价格竞争一旦开打,后续模型厂商的利润空间和差异化路径都会面临新考验。


2. Hermes Agent 上线 MoA 多模型协作:用组合模型追赶顶尖闭源模型

7 月 1 日,AI 助手平台 Hermes Agent 正式上线 MoA(Mixture of Agents)功能。用户可以在设置中自由组合多个模型:部分模型作为“参考模型”先对问题发表意见,再由“聚合模型”综合判断并调用工具执行任务。这种编排思路类似于 Sakana AI 此前推出的 Fugu 系列模型路由方案。

据平台方披露,其组合模型在 Nous Research 即将发布的基准测试中评分超过了 Opus 4.8 和 GPT-5.5。实测案例中,用 Kimi K2.6 和 minimax-m3 作参考、glm-5.2 作聚合模型生成的一款小游戏,虽然耗时和成本比单一模型有所增加,但在流畅度、关卡合理性上表现更好;而用 Grok 系列作参考、GPT-5.5 作聚合时,任务完成速度甚至比单一模型更快。

值得关注:当单一“最强模型”越来越受限或昂贵,MoA 代表了一种替代路径:与其等待一个万能模型,不如让多个各有所长的模型协同工作。这种趋势把竞争焦点从模型本身转移到“编排能力”上,对开源模型和中小开发者是一大利好。但多模型协作也意味着更高的系统复杂度和不可控的 token 消耗,真正规模化还需要更成熟的成本控制和错误回滚机制。


3. DeepSeek 完成 74 亿美元融资:梁文锋自掏 30 亿美元,称被 Claude Mythos 刺激

据智源社区与华尔街见闻 7 月 1 日报道,DeepSeek 已完成约 74 亿美元融资,其中创始人梁文锋个人出资约 30 亿美元,占融资总额约五分之二。融资的直接导火索,是梁文锋看到 Anthropic 的 Claude Mythos 凭借海量算力和数据展现出超强能力后,意识到不储备资金将无法参与下一轮竞争。

融资后,DeepSeek 宣布所有部门招聘人数至少翻倍,目前团队约 300 人,核心部门 Harness 正在加紧面试。报道还披露,DeepSeek 正在适配华为芯片,因需重写底层软件已 15 个月未发布新模型。但梁文锋仍坚持开源、低价、专注 AGI 的长期路线。数据显示,DeepSeek-V4 在 Vercel AI Gateway 平台的 token 用量份额一个月内升至 17%,成为第三大模型;V4 Flash 价格比 Anthropic 模型便宜 20 到 50 倍

值得关注:DeepSeek 的融资再次证明,中国顶尖 AI 实验室已经必须在全球 AGI 竞赛中与对手比拼资本和算力储备。梁文锋把 Claude Mythos 视为“警钟”,说明国际前沿模型的每一次突破都会直接传导到国内融资与人才市场。同时,15 个月没有新模型也提醒外界:开源和低价战略虽然赢得了开发者口碑,但在算力自主和迭代速度上仍存在现实压力。


4. 月之暗面 Kimi 估值涨至 315 亿美元,ARR 突破 3 亿美元

7 月 1 日,Readhub 报道 月之暗面 已完成上一轮 200 亿美元估值融资的交割,并启动新一轮融资,投前估值涨至 315 亿美元。截至 6 月中旬,其年化经常性收入(ARR)已突破 3 亿美元,其中 API 收入占比超过 七成,海外付费用户和 API 收入均增长 400%,产品进入 200 多个国家和地区。

价格与收入的走势同样值得关注:Kimi 输入价格从 K2 的每百万 token 4 元上调至 K2.7 Code 的 6.5 元,涨幅约 60%,但同期收入增长达 3 倍,显示模型能力提升已能转化为更强的付费能力。此外,SpaceX 以 600 亿美元收购 Cursor 时,其 Composer 2 模型正是基于 Kimi K2.5 构建,这也在一定程度上验证了 Kimi 在开发者生态中的影响力。

值得关注:Kimi 的商业化路径正在接近 Anthropic 早期的收入曲线。对国内大模型公司来说,模型能力、开发者生态和海外收入是摆脱“只烧钱不赚钱”标签的关键指标。月之暗面这一轮估值和 ARR 双涨,说明市场开始愿意为“可规模化的模型调用收入”买单,而不是只看参数和榜单。


5. 寒武纪市值突破 1 万亿元,科创板首支万亿 AI 芯片股诞生

7 月 1 日,寒武纪 股价日内涨超 7%,再创历史新高,市值正式突破 1 万亿元人民币,成为科创板首家市值破万亿的公司。若以近 11 个月计算,其股价累计涨幅已达到约 363%,年内涨幅也超过 77%。

这一市值背后是全球 AI 算力需求持续紧张的背景。寒武纪作为中国 AI 芯片领域的代表性企业,产品覆盖云端训练/推理芯片、边缘智能芯片等,客户涵盖互联网、政务、交通等多个行业。市场将其视为国产算力自主可控的核心标的之一,股价也随 AI 资本开支扩张而持续走高。

值得关注:寒武纪万亿市值既是资本市场对国产 AI 芯片长期价值的押注,也反映了当前 AI 产业链的高度情绪集中。万亿市值之后,公司的估值将更加依赖真实订单、出货量、毛利率和大客户结构。国产芯片的“从 0 到 1”故事已经基本讲完,下一步能否兑现“从 1 到 10”的业绩,将决定这场资本狂欢是否能持续。


今日小结

今天的 AI 行业呈现出几条清晰主线:

  • Agent 商业化竞争从“能力”转向“成本”:Anthropic 用 Sonnet 5 打性价比牌,说明头部厂商已经意识到企业更关心“以什么成本完成工作”,而非单纯的性能排名。

  • 多模型协作成为新范式:Hermes MoA 和 Sakana Fugu 等方案表明,未来 AI 应用可能由多个模型协同完成,而非依赖单一超级模型。

  • 中国大模型进入资本储备竞赛:DeepSeek 和月之暗面的融资/估值双双上涨,显示国内顶尖 AI 实验室正在加速“补弹药”,同时商业化也在逐步跑通。

  • 国产 AI 芯片情绪高涨:寒武纪市值破万亿,既是国产算力自主可控的象征,也意味着市场对业绩兑现的期待被进一步抬高。

AI探究员大白

0 评论数