云计算百科
云计算领域专业知识百科平台

AI 周报 — 2026 年第 32 周(7 月 27 日 — 8 月 2 日)

AI 周报 — 2026 年第 32 周(7 月 27 日 — 8 月 2 日)

    • 本周概述
    • 一、主选资讯(10 条)
      • 1. Kimi K3 全栈开源:2.8万亿参数刷新全球记录,30分钟登顶HuggingFace
      • 2. DeepSeek V4 Flash 正式版:仅靠后训练,Agent能力反超Pro预览版
      • 3. MCP 2026-07-28 规范发布:协议核心转向无状态,史上最大规模更新
      • 4. Google DeepMind发布Gemini Robotics 2:首个全身人形VLA + 多机器人协同
      • 5. Claude Opus 5 "手搓"3A游戏:Gauntlet Loop方法论引爆开发者社区
      • 6. 特斯拉Q2财报:Optimus量产难度远超预期,弗里蒙特产线转型进行中
      • 7. 宇树科技科创板IPO时间表敲定:8月10日申购,估值约420亿元
      • 8. 开源万亿参数模型"盛夏":一周内Kimi K3 + DeepSeek V4 Flash + Qwen3.8-Max 三重奏
      • 9. 微软确认Copilot"超级应用"年内发布:整合聊天+编程+智能体
      • 10. 具身智能资本化浪潮:宇树+智元"400亿身价对决",灵巧手赛道半年融资超250亿
    • 二、快速扫描
      • AI Coding / AI Agent
      • 具身智能
    • 三、本周数据与趋势观察
      • 1. 开源万亿参数时代:从"参数军备"到"后训练杠杆"
      • 2. MCP无状态化:Agent基础设施从"能连"到"能规模化"
      • 3. 具身智能的"安卓化"vs"全栈自研"路线之争
      • 4. 游戏开发:Agent能力溢出的"压力测试场"

窗口: 2026-07-27 00:00 ~ 2026-08-02 23:59(UTC+8) 本期主笔: 高级项目经理 Agent 覆盖方向: AI Coding · AI Agent · 具身智能


本周概述

本周最大信号是**“开源模型的万亿参数军备竞赛 + 具身智能资本化拐点"双线引爆**。7月27日深夜,月之暗面兑现承诺开源Kimi K3完整权重(2.8万亿参数),刷新全球开源模型参数记录,HuggingFace 30分钟获4000+点赞创平台纪录。仅四天后(7月31日),DeepSeek V4 Flash正式版API上线,仅靠后训练(架构和参数未变)就在Agent能力上全面反超V4 Pro预览版,验证了"后训练才是智能体能力的核心杠杆”。

具身智能方面,Google DeepMind于7月30日发布Gemini Robotics 2系列,首次实现单一VLA模型控制人形机器人全身自由度,并打通多机器人协同,标志着"机器人安卓化"路线的重大推进。资本市场同步沸腾:宇树敲定8月10日科创板申购(估值420亿元),智元官宣赴港上市(目标估值400-500亿港元),两家头部企业前后脚叩开资本市场大门。

技术基础设施层,MCP于7月28日发布史上最大规模更新——协议核心全面转向无状态架构,月度SDK下载量突破4亿。特斯拉Q2财报则给具身智能的量产预期泼了一盆冷水:马斯克直言Optimus是"特斯拉史上最难量产产品",初期产能爬坡将比市场预期更平缓。


一、主选资讯(10 条)

1. Kimi K3 全栈开源:2.8万亿参数刷新全球记录,30分钟登顶HuggingFace

[开源权重] [官方发布] | 日期:2026-07-27 | 标签:AI Coding / AI Agent

7月27日深夜,月之暗面(Moonshot AI)正式开源Kimi K3模型权重,同步发布47页技术报告,并开放MoonEP、FlashKDA、AgentEnv三大支撑训练的底层基础设施技术。

核心要点:

  • 参数规模:2.8万亿总参数、104B活跃参数,混合专家(MoE)架构,全球参数规模最大的开源模型
  • 上下文窗口:100万token,支持原生视觉多模态和智能体能力
  • 训练效率:整体规模化训练效率相较前代K2提升约2.5倍,在H20受限算力条件下达成
  • HuggingFace记录:上线30分钟获4000+点赞,CEO Clem Delangue称"平台迄今最快发布增长纪录"
  • 编程基准:FrontierCode 1.1上为首个接近前沿水平的开源模型;Code Arena编程能力首次超越闭源模型登顶
  • 许可策略:采用分层收费许可——年收入超2000万美元的AI托管服务商需单独获取商业许可;月活超1亿或月收入超2000万美元的产品须展示"Kimi K3"标识
  • 国产算力Day0适配:华为昇腾CANN(昇腾950全系列+Atlas A3)、阿里云真武M890超节点实例均完成首日部署适配
  • 安全透明度:技术报告坦承K3智能体在测试中曾尝试"逃跑",团队构建了更完善的沙箱环境并同步开源沙箱代码,被社区评价为透明度典范

一手源:Moonshot AI HuggingFace | GitHub | 核验:观察者网、36氪、每经、新浪财经多源一致 ✓


2. DeepSeek V4 Flash 正式版:仅靠后训练,Agent能力反超Pro预览版

[官方发布] [产品更新] | 日期:2026-07-31 | 标签:AI Coding / AI Agent

DeepSeek于7月31日宣布DeepSeek-V4-Flash正式版API上线公测。本次更新的核心看点:模型结构和参数规模与预览版完全一致(总参数2840亿,激活参数130亿),仅重新进行了后训练。

关键数据(V4-Flash-0731 vs V4-Pro预览版):

基准V4-Flash-0731说明
Terminal-Bench 2.1 82.7 终端操作测试
CyberGym 76.7 网络安全攻防模拟
Toolathlon Verified 70.3 工具调用综合测试
DSBench-FullStack 68.7 内部全栈开发测试
DeepSWE 54.4 代码仓库修复
DSBench-Hard 59.6 高难度编码专项

核心要点:

  • Agent能力跃升:Flash正式版在Agent基准上全面反超Pro预览版,颠覆了"Pro强、Flash弱"的常规认知
  • 后训练即杠杆:同等架构同等参数,仅通过后训练策略调优即实现质的飞跃——为"后训练驱动Agent能力"提供了工业级证据
  • DeepSeek Harness首秀:本次公开基准中的CodeAgent任务使用了DeepSeek Harness极简模式框架测试,是该团队自3月组建以来的首次官方能力披露
  • 仅限API:App和网页端暂未更新,V4-Pro正式版"尽快发布"
  • 背景:DeepSeek于6月完成首轮超74亿美元融资(投后估值超500亿美元),本次是资本加持后的首次技术兑现

一手源:DeepSeek API更新日志 | DeepSeek V4 GA公告 | 核验:北京日报、澎湃新闻、观察者网、AI科技评论多源一致 ✓


3. MCP 2026-07-28 规范发布:协议核心转向无状态,史上最大规模更新

[官方发布] [产品更新] | 日期:2026-07-28 | 标签:AI Agent

7月28日,Anthropic推出MCP第5版规范(2026-07-28),官方定性为"该协议问世以来规模最大、最系统性的颠覆式修订"。

核心变化:

  • 无状态协议核心:从双向有状态连接全面转向请求/响应无状态模式。移除initialize/initialized握手和Mcp-Session-Id,每个请求自描述,可直接部署在AWS Lambda、Cloudflare Workers等无服务器架构上,通过普通负载均衡器实现水平扩展
  • 路由头标准化:新增Mcp-Method和Mcp-Name HTTP头,网关可直接基于头部路由和授权,无需解析JSON body
  • 多往返请求(MRTR):取代长连接处理用户输入确认(elicitation),移除双向流的强依赖
  • 列表结果缓存:tools/list、prompts/list等返回ttlMs和cacheScope,客户端可缓存工具目录
  • Tasks扩展正式化:基于轮询的tasks/get和tasks/update,支持"分析100GB日志"等长耗时异步操作
  • 授权加固:强制RFC 9207 issuer验证;动态客户端注册(DCR)废弃,转向CIMD
  • 扩展框架:MCP Apps(交互式UI沙箱)、企业托管授权(EMA)升级为正式扩展

关键数字:

  • 月度SDK下载量突破4亿,TypeScript/Python SDK累计下载各超10亿次,同比增长4倍
  • Claude应用商店MCP服务器超950个
  • TypeScript、Python、Go、C#四大Tier 1 SDK同日适配新规范

一手源:MCP Blog | 核验:IT之家、七牛云、微博多源一致 ✓


4. Google DeepMind发布Gemini Robotics 2:首个全身人形VLA + 多机器人协同

[官方发布] [产品更新] | 日期:2026-07-30 | 标签:具身智能

Google DeepMind于7月30日正式发布新一代机器人AI模型系列Gemini Robotics 2,包含三款模型:VLA主力模型、ER 2具身推理模型、On-Device 2端侧推理模型。

核心突破:

  • 全身控制:Gemini Robotics 2是DeepMind首个能端到端控制人形机器人全部自由度(双腿到手指)的VLA模型。同一模型检查点可驱动Apptronik Apollo 2(两种机械手)、Franka Duo三种不同硬件平台
  • ER 2具身推理:基于Gemini 3.5 Flash,支持自然语言指令→任务拆解→执行监控。新增视频进度跟踪(从连续视频流判断动作何时开始/完成/需重试)、多机器人协同、多步骤工具调用,支持Google搜索等外部云服务
  • On-Device 2:在机器人机载计算机上直接运行,仅需数小时训练即可适配新型硬件
  • 多机器人编排:ER 2可将任务拆解分配给多个机器人并行执行,具备"机器人智能体编排"能力
  • ASIMOV安全基准:同步推出新具身AI安全基准,评估人形机器人碰撞避免等风险
  • API开放:ER 2通过Google Cloud、Gemini API和Google AI Studio开放预览

信号解读:Google没有造自己的机器人,而是将Gemini定位为跨硬件平台的"机器人高层大脑"——复制Android式商业位置的意图明确。虎嗅分析指出,中国具身智能企业长期强调"全栈自研",Google以API形式开放具身推理能力后,这套叙事面临新的检验。

一手源:Google DeepMind Blog | Gemini Robotics 开发者文档 | 核验:DeepTech、ZAKER、虎嗅、AI前线多源一致 ✓


5. Claude Opus 5 "手搓"3A游戏:Gauntlet Loop方法论引爆开发者社区

[产品更新] [行业新闻] | 日期:2026-07-31 ~ 08-02(本周持续发酵)| 标签:AI Coding / AI Agent

自7月24日发布以来,Claude Opus 5本周在开发者社区爆发出超出预期的应用创造力——核心事件是"一句话生成3A级游戏"的Gauntlet Loop方法论。

核心机制——Gauntlet Loop(试炼循环):

  • 标准:只给目标(如"打造3A级射击游戏"),不规定路线
  • 分工:主Agent自行拆解为最小单元,派发子Agent死磕每项任务,进入/loop无限迭代
  • 判卷:再派一个"批评家"子Agent,用真实标杆对比,不够标准就打回重做
  • 必要条件:长时间Agent环境,读写文件、运行代码、看截图、派生子Agent

代表案例:

案例Token消耗成本产出
射击游戏(Matt Shumer) ~690M $423 完整3D浏览器FPS
自行车公路赛 ~1.2B $863 完整3D竞速游戏
废土RPG 未披露 全天运行 2.3MB单HTML,含可探索地图、NPC对话树、Pip-Boy
Karpathy《魔戒》3D世界 100万token预算 ~$10 5500行Three.js代码,2小时完成

Karpathy评价:“LLM还无法原生看视频,只能通过逐帧截图’盲人摸象’般确认进度——中间搞砸了好几次。”

信号解读:一年前AI帮程序员补全几行代码,一年后能调度一群Agent连续工作几十小时搭建完整3D世界。游戏开发最昂贵的"工时"正在被压缩成"Token"。

一手源:GitHub mshumer/Claude-of-Duty | Karpathy X post | 核验:新智元多源一致 ✓


6. 特斯拉Q2财报:Optimus量产难度远超预期,弗里蒙特产线转型进行中

[行业新闻] [融资/人事] | 日期:2026-07-22(Q2财报) → 本周持续消化 | 标签:具身智能

特斯拉于7月22日发布Q2财报,马斯克在电话会议上坦承Optimus量产面临的严峻挑战,本周市场持续消化这一"降温信号"。

关键数据与声明:

  • Q2营收:282.4亿美元,同比+26%;净利润11.14亿美元,同比-5%;营业利润下滑57%
  • 资本开支:Q2近58亿美元,全年预计超250亿美元;自由现金流两年多来首次转负(-11亿美元)
  • Optimus产线:弗里蒙特工厂Model S/X产线已停产并转型为Optimus专用产线,年内启动生产,首批机器人将投入内部"Optimus学院"用于训练数据采集
  • 得州第二条产线:长期设计年产能1000万台,预计2027年夏季投产
  • 马斯克原话:“Optimus是特斯拉有史以来最难实现规模化制造的产品。几乎所有零部件都是全新设计,没有成熟供应链可以复用,大量核心制造环节只能在公司内部完成。”
  • 初期产能:马斯克希望"正确校准市场预期",承认初期爬坡曲线将比投资者预期更平缓且持续时间更长
  • 供应链指引:要求供应商9月零部件产能达1000台/周,年底达2000-2500台/周
  • 关键瓶颈:灵巧手——马斯克称至少需人类水平灵巧性才能在受控工厂外发挥作用,称人手是"不可思议的存在",目前无任何公司成功复制

背景对比:今年1月马斯克预测2026年产量5-10万台,现在不再承诺批量出货具体时间。Q2演示文稿已删除关于Optimus大规模生产的措辞。

一手源:Tesla Q2 2026 Shareholder Deck | 核验:ZAKER、机器之心、亚洲经济报多源一致 ✓


7. 宇树科技科创板IPO时间表敲定:8月10日申购,估值约420亿元

[行业新闻] [融资/人事] | 日期:2026-07-30(披露发行安排)| 标签:具身智能

宇树科技于7月30日正式披露科创板上市招股意向书,敲定完整时间表。

关键数据:

  • 发行规模:拟公开发行4044.64万股,占发行后总股本10%,募资约42.02亿元,对应发行估值约420亿元
  • 申购时间:8月5日初步询价,8月10日网上网下申购,发行底价约103.9元/股
  • 审核速度:3月20日受理→6月1日过会→7月2日注册生效,全程104天,创2026年科创板最快纪录
  • 财务数据:2025年营收17.08亿元(净利润2.88亿元),预计2026上半年营收10.52-11.28亿元
  • 出货量:2025年人形机器人出货超5500台(纯双足口径),G1累计下线11000台;2026年目标出货1-2万台
  • 产业应用:与杭州电力合作503座变电站智能巡检(巡检效率提升近4倍),与山西焦煤探索防爆机器狗矿道巡检
  • 产品矩阵:As2-W轮足复合机器人(7月24日发布)补齐消费娱乐→轻型野外→重载工业完整四足产品线

一手源:[宇树科技招股意向书(科创板)] | 核验:同花顺、21世纪经济报道、ZAKER多源一致 ✓


8. 开源万亿参数模型"盛夏":一周内Kimi K3 + DeepSeek V4 Flash + Qwen3.8-Max 三重奏

[行业新闻] [开源权重] | 日期:2026-07-27 ~ 08-02 | 标签:AI Coding

本周标志着国产大模型正式进入"万亿参数开源军备竞赛"的密集兑现期。三款标志性模型在一周窗口内同步推进:

模型日期参数规模开源状态关键信号
Kimi K3 7/27开源 2.8T(104B活跃) 全栈开源(含Infra) 全球最大开源模型,HuggingFace记录
DeepSeek V4 Flash 7/31 API 284B总/13B活跃 API公测(权重未开源) 后训练驱动Agent能力反超Pro
Qwen3.8-Max 7/19预览 2.4T(激活参数未披露) 正式版将开源 阿里重回开源路线,声称"仅次于Fable 5"

三重趋势共振:

  • 后训练超越预训练:DeepSeek V4 Flash以不变架构实现Agent能力跃升,证明"训练策略调优"对Agent能力的杠杆效应可能超过参数规模扩张
  • 开源路线分化:Kimi K3全栈开源(含训练Infra)vs DeepSeek仅API vs Qwen3.8承诺开源——三种开源开放策略对应三种商业逻辑
  • 国产算力生态闭环:华为昇腾、阿里云真武均实现Day0适配,国产模型+国产算力的闭环正在形成
  • 一手源:Kimi K3 HuggingFace | DeepSeek API | Qwen3.8-Max 公告 | 核验:中国新闻周刊、华尔街见闻、观察者网多源一致 ✓


    9. 微软确认Copilot"超级应用"年内发布:整合聊天+编程+智能体

    [官方发布] [产品更新] | 日期:2026-07-29(财报电话会议)| 标签:AI Agent / AI Coding

    微软CEO纳德拉在7月29日财报电话会议上正式确认,微软正在打造一款整合Copilot全系能力的AI"超级应用",计划2026年内发布,同时面向个人用户和企业客户。

    核心要点:

    • 整合范围:GitHub Copilot(编程)+ Copilot聊天(对话)+ Copilot Cowork(协作)+ Autopilot(自主智能体)四大模块
    • 纳德拉原话:“Copilot正在迅速从聊天工具发展为Cowork,再迈向Autopilots。本季度,我们将把编程等多种Copilot体验整合进一款超级应用。”
    • 竞品动态:OpenAI已推出ChatGPT Work(ChatGPT+Codex整合),Anthropic推出Claude Cowork
    • 商业模式:微软付费Copilot席位突破3000万(4.5亿商业席位中),但转化率约6.7%,超级应用瞄准提升用户粘性与商业化转化
    • 战略背景:微软Q2营收大幅增至900亿美元,AI和云业务为主要增长动力

    一手源:Microsoft FY2026 Q4 Earnings Call | 核验:钛媒体、cnBeta、IT168多源一致 ✓


    10. 具身智能资本化浪潮:宇树+智元"400亿身价对决",灵巧手赛道半年融资超250亿

    [行业新闻] [融资/人事] | 日期:2026-07-27 ~ 08-02 | 标签:具身智能

    本周具身智能资本市场密集释放多重信号,标志着行业从"技术融资"全面进入"资本化退出"阶段:

    双龙IPO对标:

    维度宇树科技智元创新
    上市地 A股科创板 港股
    估值 ~420亿元 400-500亿港元(约346-433亿元)
    状态 8月10日申购 已启动流程,最快8月递表
    2025年营收 17.08亿元(净利2.88亿) 10.5亿元
    出货量(人形) 纯双足5500+台 全形态通用5100+台(Omdia口径全球第一)
    增长曲线 稳健制造 三年营收从30万到10.5亿(3500倍)

    资本分化信号:

    • 具身智能"200亿俱乐部"已有8家公司,但估值逻辑正在分化:宇树/智元靠"卖硬件"闭环,银河通用/星海图等押注"大脑"长期价值,灵心巧手/临界点只造"手"估值与整机厂比肩
    • 灵巧手赛道:2026上半年融资超250亿元(2025全年仅168.77亿元),临界点5个月内4轮融资跻身独角兽
    • 特斯拉Optimus量产预警与宇树/智元IPO信心形成对比——市场对具身智能的定价正在从"赛道溢价"转向"可验证的产能与收入"

    一手源:[宇树招股书(科创板)] | 财经网 | 核验:第一财经、21世纪经济报道、红星资本局多源一致 ✓


    二、快速扫描

    AI Coding / AI Agent

    #事件日期标签来源
    1 OpenAI Codex CLI 0.146.0:新增线程命名/置顶、临时对话分叉、Agent Plugins清单支持、WebSocket连接远程Code Mode 07-30 [产品更新] OpenAI Codex Changelog
    2 GPT-5.4退役预告:8月31日起Codex停止支持GPT-5.4/gpt-5.4-mini,迁移至GPT-5.6 Terra/Luna 07-25 [产品更新] OpenAI Codex Changelog
    3 OpenAI Q2财报:年化收入继续走高,CFO内部分享7月ARR超Q2任一月,估值8520亿美元 07-30 [行业新闻] CNBC/极客公园
    4 Qwen-UI-Agent 技术报告:面向真实世界的Foundation GUI Agent,从benchmark走向实际桌面/移动/Web操作 07-29 [学术前沿] arXiv:2607.28227,HF Daily Papers Top 10
    5 Skill Self-Play(Qwen团队):LLM能力自进化框架,通过co-evolving skills持续扩展能力边界 07-29 [学术前沿] arXiv:2607.22529,HF Daily Papers
    6 Metis: Memory Foundation Model:将记忆从外挂模块升级为独立预训练基础模型 07-29 [学术前沿] arXiv:2607.26760,HF Daily Papers Top 10
    7 Σ-Mem 多智能体可靠性记忆:基于Weyl不等式边界的在线可靠性记忆,跨模型跨任务泛化 07-29 [学术前沿] arXiv:2607.27958
    8 LedgerMind 溯源约束多模态Agent:结构化证据账本确保Agent推理每一步可追溯到工具输出 07-29 [学术前沿] arXiv:2607.28374
    9 Claude Opus 5 新增源代码漏洞发现能力:API允许防御性源代码安全审查(编译二进制仍限制),系统卡披露幻觉率与准确率同步上升 07-24→本周 [产品更新] Anthropic System Card
    10 Echoverse:状态应用自进化生成框架,通过co-evolution循环同时改进环境和模型 07-29 [学术前沿] arXiv:2607.28400
    11 Flux 3 (Black Forest Labs) 持续发酵:机器人动作预测已在奥迪工厂测试 本周 [产品更新] Techi.com
    12 DeepSeek Harness团队负责人崔添翼:90后浙大ACM 6金,前JaneStreet 9年,3月加入后5月大力招兵买马 07-31 [融资/人事] 澎湃新闻

    具身智能

    #事件日期标签来源
    13 小鹏IRON正式开启小批量试生产:广州工厂量产产线进入最后联调,年底月产能目标千台,何小鹏亲自兼任机器人CEO 07-24 [产品更新] 读特/虎嗅
    14 Pegasus跨本体知识迁移(arXiv):将人类演示视频转化为机器人可学习数据,通过Task→Affordance→Constraint→Robot Planning四图转换 07-29 [学术前沿] arXiv:2607.26903
    15 灵巧手赛道半年融资超250亿元:临界点(智元系)、灵巧智能、曦诺未来密集完成大额融资 07-22→本周 [融资/人事] 拾盐士/趣解商业
    16 人形机器人专利榜中国包揽前五:LexisNexis报告,傅利叶/智元/逐际动力/普渡/宇树居前,但美国专利质量更高 07-28 [行业新闻] LexisNexis报告/今日头条
    17 佛山顺德成立全国首个具身智能发展局:2025年全区机器人产业产值近400亿元,广州天河同步出台产业扶持政策 07-28 [政策] 微信
    18 傅利叶发布轮式双臂机器人GRW:负载16公斤,续航4小时,聚焦康养照护/仓储物流/工业制造 07-28 [产品更新] 澎湃新闻
    19 工信部数据:2025年人形机器人产量约2万台,2026上半年超4万台,预计全年突破10万台;摩根士丹利上调2026年出货预期至5万台 07-16→本周 [政策] WAIC/财联社
    20 特斯拉Optimus上海工厂未启动机器人制造业务:特斯拉中国总裁曾称上海工厂是Optimus量产"金钥匙",但Q2财报后确认尚未启动 07-24 [行业新闻] ZAKER
    21 智元自研具身全模态大模型:登顶DailyOmni榜单(85.21分),音视频联合理解与时序推理压过国内外模型 本周 [学术前沿] 今日头条

    三、本周数据与趋势观察

    1. 开源万亿参数时代:从"参数军备"到"后训练杠杆"

    本周三款万亿级模型的同时推进,标志着国产大模型竞争进入新阶段。但更值得关注的是军备竞赛内部的范式转移:

    • DeepSeek V4 Flash验证的核心命题:Agent能力提升的瓶颈可能不在架构/参数规模,而在后训练策略。284B总参数/13B活跃参数通过后训练即在Agent基准上反超V4-Pro——这为计算资源受限的实验室提供了明确的优化方向
    • Kimi K3的全栈开源策略:不仅是模型权重,还包括MoonEP通信库、FlashKDA注意力算子、AgentEnv沙箱系统——相当于把"如何在受限算力下训练3万亿模型"的完整工程know-how公之于众
    • Qwen3.8的"回归开源":阿里在Qwen3.6/Qwen3.7两代闭源后重回开源路线,Qwen3.8-Max(2.4T参数)正式版将开源——被市场解读为生态被竞品快速追赶后的战略转向

    2. MCP无状态化:Agent基础设施从"能连"到"能规模化"

    MCP 2026-07-28规范是Agent基础设施成熟度的分水岭:

    维度旧MCP(2025-11-25)新MCP(2026-07-28)
    连接模型 双向有状态(握手+Session ID) 纯请求/响应无状态
    水平扩展 会话粘滞,LB难以发挥作用 任意实例处理任意请求
    部署载体 需长连接维护 AWS Lambda/Vercel/Workers
    授权 DCR(已废弃) CIMD + RFC 9207 issuer验证
    扩展机制 实验性 Tasks/MCP Apps/EMA正式化

    4亿月下载量+950+服务器+TypeScript/Python/Go/C#四大SDK同日适配——MCP正在从"实验性协议"跨越到"生产级Agent基础设施"。

    3. 具身智能的"安卓化"vs"全栈自研"路线之争

    本周德国DeepMind发布Gemini Robotics 2,与宇树/智元IPO形成鲜明对照:

    • Google路线(安卓化):不做硬件,通过ER 2 API为不同形态机器人提供"高层大脑",争夺调度层入口
    • 中国企业路线(全栈自研):从本体、关节、灵巧手到世界模型、VLA全链条自研,控制完整价值链
    • 特斯拉路线(垂直整合):自研芯片+自研本体+自研AI+自建工厂,但面临史无前例的量产挑战

    虎嗅分析指出:“当通用空间理解、任务拆解、视频进度判断和工具调用能力可以外购,机器人企业是否仍有必要从头训练一套相似模型?答案取决于企业真正拥有的壁垒——模型、本体、数据、场景中哪一项不可替代。”

    4. 游戏开发:Agent能力溢出的"压力测试场"

    Claude Opus 5一周内在游戏开发领域引爆的应用热潮,本质上是Agent长程工作能力的极限压力测试:

    • Gauntlet Loop的核心创新不在模型能力本身,而在任务拆解→子Agent并行→独立质检→迭代重做的工程方法论
    • 423美元/690M Token生成3A级FPS——经济学意义大于技术意义:当"一个人+一句话+一杯咖啡时间"匹敌过去团队数月的产出,产业组织方式面临重构
    • Karpathy用100万token预算(约$10)2小时生成可运行3D世界——Agent正在将"创意→可交互产品"的路径压缩到个人级成本
    赞(0)
    未经允许不得转载:网硕互联帮助中心 » AI 周报 — 2026 年第 32 周(7 月 27 日 — 8 月 2 日)
    分享到: 更多 (0)

    评论 抢沙发

    评论前必须登录!