AI 日报 2026年5月18日 · 星期六

AI 领域今日重要动态

精选 10 条高价值资讯 · 聚焦 Agent 技术 / AI Coding / 智能应用

今日概览:Anthropic 完成 300 亿美元融资、估值突破 9000 亿美元,在企业 AI 市场首次超越 OpenAI;xAI Grok 1.5T 参数模型训练完成,剑指编程智能体赛道;腾讯连发 Ardot(AI 设计智能体)与「吐司」(AI 应用生成平台)双产品;谷歌 Gemini Intelligence 亮相,系统级跨应用 Agent 能力引发行业关注;中国大模型周调用量连续三周超越美国,全球 AI 竞争格局加速重塑。

🏆 今日里程碑

Anthropic 以 9000 亿美元估值完成 300 亿美元融资,创 AI 行业单轮融资纪录;Claude 在企业 AI 采购市场以 65% 的选择率首次超越 ChatGPT。

🤖
Agent 技术
1
荣耀宣布 AI 进入 AgenticOS 时代,操作系统全面 AI 原生化
Agent 技术 Breaking 搜狐科技年度论坛 · 5月17日
荣耀 AI 首席科学家黄非在搜狐科技 2026 年度论坛上宣布:AI 正从 ChatBot 工具向智能体操作系统演进,荣耀 AgenticOS 有望今年与 MagicOS 11 一同发布。新 OS 的核心差异在于:从传统文件系统和窗口管理,转向意图理解、Agent 调度 Memory、多智能体协同、多模态感知 + 语义交互。多家厂商将陆续跟进 AgenticOS 战略。
值得关注:这是继 Anthropic Claude Code、OpenAI Codex 之后,终端厂商首次将 Agent 能力内置到操作系统层。AgenticOS 意味着 AI 将从"应用内的功能"升级为"系统级基础设施",对 apps 生态、开发者工具链和人机交互范式均将产生深远影响。
2
谷歌 Gemini Intelligence 亮相:系统级跨应用 Agent 自动化
Agent 技术 智能应用 Google · 5月18日
谷歌发布 Gemini Intelligence,核心体验为"长按电源键,让 AI 替你跑腿"——支持跨应用自动化操作:例如"帮我叫一辆去机场的车,选最便宜的"可自动比对打车平台;"买一双 300 元以内的白色耐克运动鞋"可自动搜索电商、筛选、生成订单草稿。关键节点(支付/确认)需用户手动授权。首批支持三星 Galaxy Z Fold8/Flip8、S26 系列、Pixel 10 系列,门槛为 12GB 运行内存 + 旗舰芯片。
值得关注:Gemini Intelligence 是谷歌对 Agentic AI 的系统性押注,与苹果的 Apple Intelligence 和荣耀 AgenticOS 形成三角竞争。其"跨应用自动化 + 用户授权"的设计思路,将是行业 Agent 安全治理的重要参考范式。Google I/O 2026(5月19-20日)预计将公布更多细节。
3
蚂蚁百灵 Ring-2.6-1T 开源,AIME 26 得分 95.83
Agent 技术 开源 蚂蚁集团 · 量子位 · 5月18日
蚂蚁集团开源 Ring-2.6-1T 大模型,AIME 26 数学推理基准得分达 95.83,Agent 执行能力全面增强。该模型采用 MoE 架构,总参数 1T,激活参数规模较同级稠密模型大幅降低,适合 Agent 场景下的高效推理与多步任务规划。
值得关注:国内大模型在 Agent 执行能力上的持续突破,标志着开源生态正在缩小与闭源顶级模型的差距。Ring-2.6 的高 AIME 得分意味着其在复杂推理 + 工具调用链路上的可靠性显著提升,对构建生产级 Agent 具有重要参考价值。
💻
AI Coding
4
xAI Grok 1.5T 参数模型训练完成,剑指编程智能体赛道
AI Coding Breaking xAI · 5月18日
马斯克宣布 Grok 1.5T 参数模型已完成训练,预计 3-4 周内正式发布。为弥补 Grok 4.3 在编程领域与 Claude 的差距,xAI 海量吸纳 Cursor 代码数据进行补充训练,并通过监督微调(SFT)和强化学习(RL)进行精细打磨。市场传出 xAI 已与 Cursor 达成深度合作,甚至传闻 200 亿美元收购 Cursor。
值得关注:这是 xAI 在 AI Coding 赛道的最大押注。参数规模(1.5T)+ Cursor 代码数据 + SFT/RL 精调,三管齐下试图在编程智能体方向实现反超 Claude Code。若收购 Cursor 属实,将重塑 AI Coding 工具市场格局。Grok 5 被马斯克称为"AGI",5月连发两代万亿参数模型,竞争烈度持续升级。
5
Andrej Karpathy 每月 AI 编程消耗 130 万美元,OpenAI 展示"3人+100个AI"新范式
AI Coding 融资/战略 36氪 / 量子位 · 5月18日
"龙虾之父"Andrej Karpathy 透露其每月 AI 编程 Token 消耗约 130 万美元(约 940 万人民币),全部由 OpenAI 承担。与此同时,OpenAI 展示新开发范式:3 人 + 100 个 AI 编程智能体协作完成复杂项目,月消耗同样约 130 万美元。这标志着当成本不再是障碍时,软件开发的组织形式将彻底改变。
值得关注:Karpathy 的"天价账单"背后,是 AI Coding 从"辅助工具"向"主力程序员"跃迁的真实写照。130 万美元/月的 Token 消耗若能替代数十名工程师的人力成本,ROI 已然成立。这将加速中小团队采用 AI Coding 工具的战略决策。
6
Claude Code 论文流水线开源,6.4k Stars 涵盖从构思到完稿全链路
AI Coding 开源 GitHub Trending · 5月18日
一个开源项目完整复现了用 Claude Code 完成学术论文的全流程:从文献综述、方法设计、实验代码、数据分析到论文撰写,全部由 AI 智能体协作完成。项目展示了详细的 Token 消耗账单,费用参考透明,目前已获 6.4k GitHub Stars。
值得关注:这不仅是"AI 写论文"的展示,更是 Claude Code 作为 Agentic Coding 工具在复杂长链路任务中能力的系统性验证。透明的成本数据让开发者可以准确评估 AI Coding 的经济可行性,加速 Agent 编程工具在科研和工程中的落地。
📱
智能应用
7
腾讯连发双产品:Ardot AI 设计智能体 +「吐司」AI 应用生成平台
智能应用 AI Coding 腾讯 · 5月18日
Ardot(ardot.tencent.com):AI 设计智能体,支持"自然语言 → 设计初稿 → 可编辑 → 一键转代码"。输入"帮我做一个电商首页,要有轮播图和会员入口",5 分钟产出设计初稿,保留图层结构与组件属性,可一键导出 React/Vue 前端代码,支持产品、设计、开发多人同画布实时协作。注册即享 1000 Credits 免费额度。

「吐司」AI 应用生成平台:定位"应用生成及灵感共创平台",输入想法 → AI 自动拆解功能 → 多轮对话调整 → 一键打包 APK。支持链接/二维码/安装包分享,设有"灵感广场"支持共创接力。安卓版已上线,公测期间限时免费。
值得关注:腾讯一天内连发两款 AI 生产力工具,覆盖"设计→代码→应用"全链路,且均降低了对专业人才的依赖。Ardot 直接挑战 Figma+Cursor 的组合,吐司则对标 v0.dev / Bolt.new。这是大厂在 AI 应用层加速落地的标志性动作。
8
通义千问预告重量级新模型,5月20日阿里云峰会亮相
智能应用 模型发布 阿里 · 5月18日
阿里通义千问官方预告将在 5月20日阿里云峰会上发布重量级新模型,市场普遍预期为 Qwen 3.5 或具备更强 Agent 能力的下一代旗舰模型。结合中国大模型周调用量连续三周超越美国的背景,此次发布具有标志性意义。
值得关注:阿里云峰会是国内 AI 行业的风向标事件。若新模型在 Agent 能力上有重大突破,将进一步巩固中国大模型在全球的开源领导地位。5月20日与 Google I/O(5月19-20日)撞期,AI 模型发布进入"超级周期"。
📊
市场格局
9
Anthropic 9000 亿美元估值完成 300 亿融资,企业 AI 市场首次超越 OpenAI
融资 Breaking 红杉资本 / Dragoneer · 5月15日
Anthropic 完成 300 亿美元 G 轮融资,投后估值约 9000 亿美元,超越 OpenAI(约 8520 亿美元),创 AI 行业单轮融资纪录。年化收入预计突破 450 亿美元(半年内从 90 亿增至 450 亿,增长 4 倍+)。

企业市场数据(Ramp,覆盖 5 万+企业):Anthropic 企业采用率 34.4% vs OpenAI 32.3%;新增 AI 采购选择率 65% vs 32%;Claude Code 成为全球 GitHub 提交中占比 4% 的生成来源。
值得关注:这是企业 AI 市场的历史性转折点。Anthropic 从 2023 年 6 月的 0.03% 增长至 34.4%,三年增长超千倍。Claude Code 在编程场景的强势表现是企业采购的核心驱动力。AI 竞赛的主战场正从"消费者 ChatBot"转向"企业 Agent 平台"。
10
中国大模型周调用量连续三周超越美国,腾讯 Hy3preview 收费后仍夺冠
市场数据 趋势 全球大模型调用量统计 · 5月18日
最新数据显示:全球大模型周调用总量 26.9 万亿 Token(周环比 +4.7%),其中中国贡献 7.693 万亿 Token,美国贡献 4.24 万亿 Token,中国:美国 = 1.81:1,已连续三周超越美国。

全球 Top 2 调用模型:1. 腾讯 Hy3preview(2.66 万亿 Token,周环比 +210%);2. DeepSeek-V4-Flash。Hy3preview 在收费后调用量仍居全球第一,说明用户粘性来自模型能力而非免费策略。
值得关注:中国大模型调用量的持续领先,标志着全球 AI 消费格局正在重塑。腾讯 Hy3preview 收费后仍夺冠,是"模型能力驱动用户选择"的有力证明,对国内外大模型厂商的定价和开源策略均有重要参考意义。
📈
今日数据看板
Anthropic 最新估值
$9000亿
↑ 超越 OpenAI($8520亿)
Anthropic 年化收入
$450亿
↑ 半年增长 4 倍+
全球周调用量(中国)
7.69万亿
↑ 美国的 1.81 倍
Claude Code GitHub 提交占比
4%
↑ 全球第一 AI 生成来源
Grok 1.5T 发布倒计时
3-4周
训练已完成,敬请期待
Ant Ring-2.6 AIME 26 得分
95.83
Agent 执行能力全面增强
⚔️
Anthropic vs OpenAI 企业市场对比
指标 Anthropic (Claude) OpenAI (ChatGPT)
企业采用率 34.4% 32.3%
新增采购选择率 65% 32%
直接对决胜率 70%
12个月增长率 +283% +0.3%
最新估值 $9000亿 $8520亿
GitHub AI 提交占比 4% (Claude Code) <1% (Codex)
💡
趋势洞察

① Agent 成为主战场:从 Anthropic Claude Code、OpenAI Codex、谷歌 Gemini Intelligence 到荣耀 AgenticOS,全球主流厂商均在 Agent 方向重兵投入。Agent 已从"功能"升级为"平台级战略"。

② 编程智能体进入"天价投入"阶段:Karpathy 每月 130 万美元 Token 账单、OpenAI"3人+100个AI"实验,表明头部玩家已在用"算力换人力"的方式重构软件开发流程。

③ 中国大模型调用量持续领先:连续三周超越美国,腾讯 Hy3preview 收费后仍居全球第一,证明模型能力(而非免费策略)才是用户留存的核心。

④ 终端厂商入局 AgenticOS:荣耀 AgenticOS 的发布,意味着 Agent 能力将从云端走向操作系统层,对现有 App 生态将产生颠覆性影响。

⑤ Google I/O + 阿里云峰会撞期:5月19-20日,全球 AI 模型发布进入"超级周期",Gemini 4.0 与 Qwen 新模型的正面竞争值得密切关注。