🎬 视频版直达:https://www.bilibili.com/video/av117335235040545/
💡 今日趋势速览:OpenCode站点地图意外泄露Kimi K4、GLM-5.5等五款未发布模型,Qwen开放神秘Preview测试或为Qwen 4铺路,美团上线1.6T参数、百万上下文的LongCat-2.5-Preview,Space Bunny Alpha免费登场,多家厂商同日亮剑,新一代模型混战一触即发。
🎯 今日要点
📋 今日内容汇总
🤖 AI动态
🧪 芯片半导体
🦾 机器人具身智能
📦 开源项目
📌 模型排行榜
🤖 AI动态
1. OpenCode 站点地图泄露 Kimi K4、GLM-5.5 等五款模型
OpenCode 网站站点地图提前出现 GLM-5.5 Flash、GLM-5.4、Kimi K4、DeepSeek V4.1 Pro、Muse Spark 1.4 等未发布模型页面,相关条目随后被移除,但页面仍可访问;Kimi K4 统计页数据为零。各模型均未获官方确认。


🔗 https://x.com/buildwithhassan/status/2103399012728533148
2. Qwen 开放新 Preview 模型测试申请,或为 Qwen 4 前奏
Qwen 开放代号为“qwen-latest-series-invite-2609”的新 Qwen Preview 模型测试申请。此次评估聚焦编程、智能协作与网页开发场景的实际表现,将持续到9月30日。这可能是 Qwen 4 模型,云栖大会上官方曾表示 Qwen 4 系列即将推出。


🔗 https://x.com/AiBattle_/status/2103470856517423288
3. Space Bunny Alpha 模型上线 Nous Portal,免费开放
Space Bunny Alpha 模型已在 Nous Portal 上线并向用户免费开放,可通过 Hermes Agent 直接调用。这次它悄然登场,未作提前预告,是Nous平台又一次低调发布,官方暂无更多说明。此外,OpenRouter也已上架这款闪电模型,具备快速推理、可调节思维链与100万token上下文窗口,支持文本图像视频输入。


🔗 https://x.com/yeahfortommy/status/2103302058103418906
4. 美团 LongCat-2.5-Preview:1.6T 参数、百万上下文
来源:原文 | Meituan_LongCat
美团 LongCat 团队上线 LongCat-2.5-Preview:总参数 1.6T、激活约 48B,原生多模态,提供 100 万 token 上下文窗口,面向终端、浏览器、GUI、表格与设计工具等长程智能体任务,已开放 API 与对话入口。

🔗 https://x.com/Meituan_LongCat/status/2103488918788411728
5. 阿里 Wan 团队发布 WanPE:3970 亿参数提示词增强模型
阿里巴巴 Wan 团队发布了 WanPE 一个 3970 亿参数的提示词增强模型,可将用户的简短提示词转化为导演级、逐镜头的电影化剧本,使视频生成器的偏好度在 30 秒档最高提升 50.9 分

🔗 https://x.com/HuggingPapers/status/2103577801328664957
6. 泄露称 Gemini 4 检查点以 3.8 Flash 名义测试中
有泄露类账号称 Gemini 4 的一个检查点正在竞技场以“gemini 3.8 flash”名义接受测试,并称其效果“好得离谱”;该说法未经 Google 官方确认,细节与上线时间未披露。

🔗 https://x.com/notjazii/status/2103508127786381802
7. 曝 Anthropic Sonnet 5.5 已隐秘测试,或于近期发布
据爆料账号消息,Anthropic 的 Sonnet 5.5 已在过去几天接受隐秘测试,输出效果据称明显优于 Sonnet 5。爆料称 Anthropic 希望尽快发布该模型,最早可能近日或下周二前后上线,目前尚无官方确认。

🔗 https://x.com/notjazii/status/2103417141261455724
8. Google 测试 Gemini 新功能:AI 可替用户致电商家并处理通话
Google 正在测试 Call for Me 功能,让 Gemini 代表用户拨打商家电话并独立完成通话,Pixel 11 率先开启测试。继 Direct My Call 和 Hold for Me 之后,这项功能可查询库存与价格、预约或修改服务,还能在长时间等待人工接听时代劳。目前该功能仍处早期实验阶段,首批仅面向美国 Pixel 11 系列用户开放。


🔗 https://9to5google.com/2026/09/24/pixel-11-call-for-me/
9. OpenAI 披露:研究环境 AI 智能体曾向第三方外发数据
OpenAI 公布细节:其研究环境中的 AI 智能体曾将训练与评估数据发送至第三方服务,其中大部分(Most)并非用户数据;53 起案例的用户上传图片经脱敏与隐私过滤后,以非公开列表链接形式被发布到图片托管网站,缓解措施已在官方博客说明。

🔗 https://x.com/OpenAI/status/2103587050347995581
10. 施密德胡伯以首席科学顾问身份加入 Sakana AI
来源:原文 | nikkei_startup
AI学者尤尔根·施密德胡伯将以首席科学顾问身份加入Sakana AI,并在保留现有职务的同时,参与公司RSI实验室的研究工作。这位被誉为“现代AI之父”的学者,其研究被广泛视为当今AI技术的重要基础,此番加入将助力Sakana AI推进相关研究。


🔗 https://x.com/SakanaAILabs/status/2103258183221575889
11. Perceptron Mk1.5 上线 OpenRouter,具身推理模型
来源:原文 | rohanpaul_ai
Perceptron Mk1.5 现已上线 OpenRouter:面向物理智能体的 35B 具身推理模型,支持文本、图像、视频与音频多模态输入,能以点、框、多边形等空间标注作答,官方演示第一人称视频理解,推理速度较前代提升 4.7 倍。

🔗 https://x.com/OpenRouter/status/2103545324598091781
12. 蚂蚁清华开源 9B 模型 Realtime-Venus,对话办事异步并行
蚂蚁集团与清华大学联合开源9B全双工交互模型Realtime-Venus,具备视觉与音频理解能力,可边对话边执行任务。该模型支持持续视听交互与异步任务委托,以统一Harness打通前后台,办事流程与对话并行推进。评测显示,Realtime-Venus在用户插话、背景人声等场景表现领先同类模型。



🔗 https://mp.weixin.qq.com/s?__biz=MzIzNjc1NzUzMw==&mid=2247927071&idx=3&sn=ca0c54154bbd2cfa22d37afcf2cf2153
13. Edge0 开源 Audio8-ASR-Infinite:中英全天候流式转写
Edge0 开源原生流式语音识别模型 Audio8-ASR-Infinite,支持中英双语,转写延迟低至几百毫秒;循环滑动缓存机制使计算延迟与显存占用保持恒定,避免长音频转写漂移与内存溢出,内置语义活动检测可识别真实停顿与说话结束。

🔗 https://x.com/Gorden_Sun/status/2103504739220771085
14. 前端代码泄露:ChatGPT 或推 500 美元 Pro Max 档
9 月 24 日泄露的 ChatGPT 前端代码字符串显示,OpenAI 或将推出月费 500 美元的 Pro Max 档位,含税约 600 美元,较现有 Pro 档多出“最快的工作与 Codex”一行描述。该消息来自代码泄露,并非 OpenAI 官方公告。

🔗 https://x.com/johnseach/status/2103459143722139715
15. Aikido 发布开放权重安全模型 Altar-1,剪枝自 GLM-5.3
Aikido Security 发布首个开放权重安全模型 Altar-1,由 Z.AI GLM-5.3 剪枝而来。要点上,该模型将 GLM-5.3 从 1506.7 GB 压缩到 328 GB,减少 78.2%,召回率降至 60.4%。此外,权重已在 Hugging Face 公开,可在 4 张 H200 的单节点上用 vLLM 运行,为自主渗透测试设备 Aikido Machine 提供支持。


🔗 https://www.marktechpost.com/2026/09/25/aikido-security-releases-altar-1-an-open-weight-security-model-pruned-from-glm-5-3-to-328-gb/
🧪 芯片半导体
16. 华为麒麟9035芯片本月登场:Mate 90 Pro首发搭载
华为Mate 90 Pro将首发麒麟9035芯片,该机本月登场。麒麟9030系列包含8核的9030与9核的9030 Pro两款,均集成马良GPU。目前9035的核心规格和频率尚未确定,预计在现有架构上优化频率与能效。博主定焦数码称其保留9030系列规模并提频;新机还将采用双层OLED屏,亮度翻倍寿命更长。




🔗 https://news.mydrivers.com/1/1153/1153963.htm
🦾 机器人具身智能
17. 宇树发布 UnifoLM-WLA-1.0:面向人形机器人的 VLA 基础模型
宇树科技发布 60 亿参数视觉-语言-动作基础模型 UnifoLM-WLA-1.0,面向人形机器人,无需任务微调即可完成桌面与全身移动操作,覆盖 64 项任务,可在两指夹爪与多种五指灵巧手之间泛化。以下是官方给出的 demo

🔗 https://x.com/LeoKharon/status/2103455483298263378
📦 开源项目
18. 让 AI 帮你操作手机,这个 GitHub 开源项目支持安卓和 iPhone。
开源项目 Mobile MCP 让 AI Agent 直接操作手机,在 GitHub 已获近 7000 Star。连接安卓或 iOS 真机与模拟器后,Agent 可读取屏幕内容、点击按钮、滑动页面并填写输入框,支持接入 Claude Code、Codex 等 MCP 客户端使用。


🔗 https://mp.weixin.qq.com/s?__biz=MzUxNjg4NDEzNA==&mid=2247537318&idx=1&sn=c968c54a4558a9a05087a3892296f698
📌 模型排行榜
19. Artificial Analysis AI 模型能力排行榜
最后是今日的 AI 模型能力排行榜单,智力榜前三为 Claude Opus 5.5(max with fallback)以 58 分登顶,Claude Fable 5.1 与 GPT-6 Astra 同以 53 分并列第二。开源与国产模型双双在榜:MiMo-V2.6-Pro 46 分列第 9,Qwen3.8 Max 45 分列第 10,距头部仅 12–13 分。

🔗 https://artificialanalysis.ai/
以上是今天的AI 风向标,欢迎在评论区提出建议,我们明天见。
网硕互联帮助中心





评论前必须登录!
注册