AI DAILY BRIEFING

AI 日报

Agent 技术 · AI Coding · 智能应用

2026年4月19日(周日)· 今日精选 8 条

🤖 具身智能 2 💻 AI Coding 2 🧠 大模型 2 💰 融资 1 🔬 前沿研究 1

今日头条

1
2026 北京亦庄人形机器人半程马拉松今日开跑:百余支队伍,全球首个机器人马拉松第二届
具身智能 Agent 智能应用

由北京市人民政府、中央广播电视总台等联合主办的 2026 北京亦庄半程马拉松暨人形机器人半程马拉松,今日(4月19日)上午 7:30 在北京经济技术开发区正式鸣枪开跑,赛程全长 21.0975 公里。

相比去年首届,本届赛事规模实现近 5 倍增长,吸引超过 100 支赛队参与,其中包含 4 支国际赛队,分为自主导航和遥控两大技术赛道。参赛阵容涵盖宇树 H1、天工 Ultra、智元灵犀 X2、优必选、小米等国内一线人形机器人,以及多支高校队伍。宇树 H1 此前已完成百米速度 10 m/s 巡航测试,天工 Ultra 携带全新步态算法参赛,双方均为自主导航赛道夺冠热门。

赛道由科创十七街与通惠干渠路交叉口起跑,全程穿越亦庄核心商业区。自主导航赛队需独立应对红绿灯识别、人流规避、急转弯等真实城市场景;遥控赛队则考验机器人在人力协助下的耐久度与稳定性。

参赛队伍 100+
赛程 21 km
规模增长 ~5×
为什么重要:从去年寥寥数队摇摇晃晃完赛,到今年百队同场竞技、自主导航成为主流赛道,这一跨越标志着具身智能已从"实验室演示"正式进入"规模化实战验证"阶段。马拉松赛事为人形机器人提供了最苛刻的长时续航与环境适应压测场景,结果将直接影响各厂商的技术信用和融资节奏。
来源:新华社 · 央视网 · 澎湃新闻 · 2026-04-18 / 2026-04-19
2
Cursor 洽谈 $2B+ 融资,估值直逼 500 亿美元,NVIDIA 加持 AI Coding 独角兽
AI Coding 融资

据 TechCrunch 援引四名知情人士消息,AI 编程初创公司 Cursor(前身 Anysphere)正在洽谈至少 20 亿美元的新一轮融资,投后估值预计约 500 亿美元,领投方预计包括 Andreessen Horowitz(a16z)、Thrive Capital,NVIDIA 亦参与其中。

核心财务数据:Cursor 预测至 2026 年底年收入运行率(ARR)将突破 60 亿美元,并逼近盈利节点。Cursor Composer 模型的运营成本结构已得到显著优化,企业客户(Team 版)增速尤为亮眼,成为本轮估值溢价的核心支撑。目前 Cursor 月活跃用户数达数百万,企业签约客户涵盖财富 500 强。

融资目标 $20亿+
估值 $500亿
预测ARR $60亿
为什么重要:$500 亿估值使 Cursor 跻身全球估值最高的 AI 工具公司之列,逼近 OpenAI 早期单轮融资的体量。这印证了"AI Coding 工具层"已成为 2026 年最具确定性的商业赛道——不是 AI 应用的实验,而是开发者工作流的基础设施重构。NVIDIA 参投也暗示了 GPU 算力与 AI 编程工具的深度绑定格局。
来源:TechCrunch · Tech in Asia · AI Market Watch · 2026-04-17
3
OpenAI Sora 正式关停,「Sora 之父」Bill Peebles 与 CPO Kevin Weil 同日离职
大模型 智能应用

北京时间 4 月 18 日,OpenAI 视频生成模型 Sora 核心负责人 Bill Peebles 在社交媒体正式宣布离职,同日,前首席产品官 Kevin Weil 也发帖告别。OpenAI 同步解散了专用科学研究团队,Sora 视频工具已于此前正式关停。

背景:Sora 于 2024 年初发布演示视频时轰动全球,但实际上线后用户体验与演示差距明显,商业转化远不及预期。据报道,OpenAI 过去一年在 Sora 项目上投入超 50 亿美元,实际营收仅约 200 万美元。此次关停与高管离职,标志着 OpenAI 从"消费者登月项目"向企业 AI 解决方案的战略急剧收缩,此前与迪士尼价值 10 亿美元的合作也随之告吹。

烧钱 $50亿
营收 $200万
为什么重要:Sora 的关停不只是一个产品失败,而是一个清晰的战略信号:OpenAI 正在主动放弃"炫技型"消费端产品,All-in 企业服务与 Codex/Agent 工具链。这对整个 AI 视频赛道是一次降温信号,也意味着 OpenAI 和 Anthropic 在 AI Coding 领域的正面对决将更加激烈。
来源:TechCrunch · 腾讯新闻 · 新浪财经 · 2026-04-18
4
阿里 Qwen3.6-35B-A3B 开源:仅需 3B 激活参数,Agentic Coding 能力媲美稠密大模型
大模型 AI Coding Agent

继 Qwen3.6-Plus 商业版发布后,阿里于 4 月 17 日正式开源 Qwen3.6-35B-A3B,这是一款基于 MoE(专家混合)架构的稀疏大模型:总参数 350 亿,但激活参数仅 30 亿,推理成本接近小模型,性能却与 Qwen3.5-27B 稠密模型持平。

核心亮点:Agentic Coding 能力是最大卖点——在 SWE-bench Verified、MultiSWE-bench 等编程 Agent 基准上表现突出,超越同等激活规模的竞品;原生支持视觉+语言+空间推理三模态;延续"thinking / non-thinking"双模式(前者做长链推理、后者做快速响应);已上线 Hugging Face 和 ModelScope,支持完整本地部署。同步支持 OpenClaw(原 Moltbot)等主流开源 AI Coding Agent 接入。

激活参数 3B
总参数 35B
为什么重要:MoE 架构正在成为开源大模型的新标准——用稠密模型数倍的参数换取推理时仅激活极小部分,实现"大脑小计算"。Qwen3.6-35B-A3B 让本地部署 Agentic Coding 能力的门槛大幅降低,对于不想依赖云 API 的企业和开发者,这是一个重要的里程碑选项。
来源:Qwen 官方博客 · IT之家 · 系统极客 · 2026-04-17
5
Claude Opus「降智」被量化实锤:BridgeBench 准确率跌 15 个百分点,排名跌出前 10
大模型 AI Coding 信任危机

困扰 Claude 社区数月的「降智」争议终于获得可量化证据。BridgeBench 第三方独立评测数据显示,Claude Opus 最新版本准确率从 83.3% 跌至 68.3%,骤降 15 个百分点,全球模型排名从第 2 名跌至第 10 名以外。

Anthropic 官方回应将此归因于「调整了默认推理强度」而非模型降级,并称属于「计费口径优化」。但对于企业用户,实际影响更为直接:重度用户账单成本最高上涨 2 倍,且必须主动配置更高推理档位才能恢复原始性能。这一模式与 OpenAI 此前被曝 GPT 系列"隐性降参"如出一辙,被开发者社区称为 AI Shrinkflation(AI 缩水式通胀)

准确率跌幅 -15%
排名变化 #2 → #10+
成本上涨 最高2×
为什么重要:头部 AI 厂商通过「调整默认参数」变相节省算力成本,正在成为行业新潜规则。用户感知的「变笨」与官方的「优化」之间存在系统性鸿沟。对于把 Claude 作为核心生产工具的团队,这意味着必须重新评估成本与能力预算,并建立持续的模型性能监控机制。
来源:AITNT 全球 AI 新闻日报 · 多课网 · 2026-04-18
6
OpenAI Codex 迎来最大升级:Computer Use + Artifact,AI 编程进入「任务执行」时代
AI Coding Agent

OpenAI 对 Codex 进行了发布以来最大规模的功能升级,两大核心新功能正式落地:

① Computer Use(计算机操作):Codex 可自动执行 UI 点击、输入、验证等操作,在沙盒中运行代码、安装依赖、启动服务,实现「生成 → 运行 → 验证」全闭环,无需人工介入中间环节。

② Artifact(即时生成与交互):生成的网页可在侧边栏实时预览,支持用户直接在页面上标注修改位置,多格式支持 PDF、PPT 等文件预览。访问渠道全面拓展:Web(chatgpt.com/codex)、CLI(npm/Homebrew)、IDE 插件(VS Code/Cursor/JetBrains)及 macOS/Windows 独立 App。

为什么重要:Computer Use 让 Codex 从「代码建议工具」升级为「数字同事」——它可以独立完成从理解需求到测试验证的全链条任务。配合 Artifact 的实时可视化,AI 编程的工作流从「交替循环」走向「并行协作」。这是 OpenAI 在 Claude Code 领先后的关键追赶动作,竞争格局正在从 benchmark 转向工作流体验。
来源:大国 AI · AITNT · 多课网 AI 日报 · 2026-04-18
7
Google Gemini Robotics-ER 1.6 × 波士顿动力 Spot:机器人首次学会「读仪表盘」
具身智能 Agent 智能应用

Google DeepMind 于 4 月 15 日发布 Gemini Robotics-ER 1.6,并同步宣布与波士顿动力达成合作,将最新模型集成进 Spot 机器狗的 Orbit AIVI-Learning 检测平台。

最显著的新增能力是 Instrument Reading(仪器读数):Spot 现可在工厂和仓库中精确读取模拟温度计、压力表等复杂仪表盘数值,这是由波士顿动力在实际工业部署中提出的真实需求。这也被 DeepMind 称为「迄今最安全的机器人模型」,在安全操作评估上显著领先前代。此外,ER 1.6 进一步增强了空间推理和精细操作能力,可更好地应对工业环境中复杂的三维空间任务。

为什么重要:「读仪表盘」听起来简单,但它代表了机器人感知能力从「感知环境」到「理解信息」的质变——机器人不只是「看到」仪表,而是「读懂」它的含义并据此决策。这使 Spot 在电力、化工、制造等高危场景的自主巡检能力大幅提升,也是 AI Agent 向物理世界延伸的重要里程碑。
来源:Google DeepMind 官方博客 · The Robot Report · 搜狐科技 · 2026-04-15
8
NVIDIA 开源 Ising:全球首个量子 AI 模型家族,量子纠错速度提升 2.5 倍
前沿研究 基础设施 大模型

NVIDIA 于 4 月 14 日正式发布 Ising 开源量子 AI 模型系列,这是全球首批专为量子处理器设计的 AI 模型,包含两款核心模型:

Ising Calibration(视觉语言模型):实现量子处理器自动校准,将原本需要数天的校准时间压缩至数小时;Ising Decoding(3D 卷积神经网络):执行量子纠错实时解码,速度是传统方法的 2.5 倍,准确率提升 3 倍

全球 20+ 顶尖机构已接入,包括 IonQ、哈佛工程学院、劳伦斯伯克利国家实验室、康奈尔大学、芝加哥大学等。开源协议为 Apache 2.0,可通过 GitHub、Hugging Face 或 build.nvidia.com 获取。黄仁勋将其定位为「量子机器的操作系统」。

纠错速度 2.5×
纠错精度
接入机构 20+
为什么重要:量子计算的最大瓶颈之一是量子纠错——量子比特极其脆弱,必须实时纠错才能保持计算准确性。NVIDIA 将 AI 引入这一环节,并选择开源路线吸引学术界集体攻关,这比以往任何时候都更接近「实用量子计算」的临界点。量子计算市场预计 2030 年突破 110 亿美元,而 NVIDIA 正在抢占底层基础设施位置。
来源:NVIDIA 官方博客 · 量子计算报告 · GitHub · 2026-04-14