今日 AI 行业前沿情报
🔥 每日重磅深度头条
Ataraxos 以 85%有效胜率击败最强人类 Stratego 选手,训练成本不足 8000 美元
研究人员开发的 AI 系统 Ataraxos 以 85% 的有效胜率(平局计半胜)击败了曾获 4 次世界冠军的史上最强 Stratego 选手 Niemeijer,并在 2025 世界锦标赛表演赛中取得 40 局 38 胜。
📈全网当前最热事件(多源交叉聚簇)
TOP 801
谷歌发布 Gemini 4 Argon 前沿模型
02
Anthropic 推迟 IPO 至 11 月,招股书曝光
03
Cloudflare 开源决策模型 Clef 与 Clef-flash
04
微软发布 MAI-Transcribe-2-Streaming 流式转写模型
05
英伟达发布 64GB 内存版 DGX Spark
06
Tavus 发布 Griffin 视频交互模型
07
Claude Code mods 发布与示例更新
08
OpenAI 解雇 3 名安全研究员
🏮国内前沿速递
10 条01Meta 旗下 AI 智能体 Muse 将登陆智能眼镜平台,可代用户完成各种任务
国内IT 之家 10 月 2 日消息,Meta 宣布旗下 AI 智能体 Muse 将于近期登陆智能眼镜,用户无需拿出手机,只需通过语音下达指令,Muse 就能在后台代用户完成一系列任务。 Meta 表示,Muse 基于 Muse Spark AI 模型运行,其核心运行环境是一台部署在云端的私有持久化 Linux 虚拟机,配备独立的网页浏览器、文件系统和终端。即使用户关闭应用,这些组件仍会持续运行。为了完……
信源:IT 之家 · 10-02 21:38
02Andrew Kelley 专访:他为何创建 Zig 、禁止 AI 贡献以及将 Zig 从 GitHub 移出
国内在接受 JetBrains 采访时,Zig 项目创建者 Andrew Kelley 详细阐述了该项目正式禁止 AI 贡献的决定,以及从 GitHub 迁移至 Codeberg 的动机。 Kelley 指出,自动提交代码最终会降低代码库的质量,并且会削弱开源参与者之间的社交纽带。 GitHub 持续出现的故障以及彼此之间的激励机制存在错位,导致该项目将代码库迁移至 Codeberg 。 Kelley 提到……
信源:InfoQ 中文 · 10-02 21:00
03桌面 AI 超算新选择:英伟达 NVIDIA DGX Spark 64GB 内存版正式发布,4999 美元
国内IT 之家 10 月 2 日消息,英伟达今天正式对外披露 DGX Spark 产品更新,推出 64GB 内存版本 DGX Spark 桌面 AI 计算机,起售价 4,999 美元 (现汇率约合 33,566 元人民币) ,将于 10 月 23 日正式发售,宏碁、戴尔、华硕、技嘉、微星、 H3C 等众多 OEM 厂商均会推出基于该平台的整机产品。 官方此前推出的 128GB 版本同步更新定价,128GB…
信源:IT 之家 · 10-02 21:00
04湖北智能家居国补范围扩大,机器人、数码相机、无人机、血压仪等可补贴 15%
国内IT 之家 10 月 2 日消息,为贯彻落实《商务部等 8 部门关于加快“人工智能 + 消费”发展的实施意见》有关要求,进一步释放湖北省智能终端产品消费潜力,推动人工智能与消费深度融合,提升居民居家生活品质,湖北省对 2026 年消费品以旧换新新增品类补贴政策作出优化调整,新规自 2026 年 10 月 1 日起正式实施。 IT 之家附智能家居补贴品类如下: 智能清洁设备:含智能扫洗地机、智能擦窗机器……
信源:IT 之家 · 10-02 20:22
05别再给 Agent 一个“毛坯房”了:构建 Agent 拎包入住的开发环境实践|QCon 上海
国内从「构建 AI 」到「驾驭 AI 」,100+ 实战案例拆解 AI Native 时代的工程新实践! 2026 年 QCon 全球软件开发大会大会 · 上海站 将于 10 月 22 日—24 日举办,聚焦 Harness AI 时代的工程实践,围绕 AI Native 架构、 Agent Runtime 、 AI Infra 、 Data Systems 、 Agent 安全与可观测、 Loop Engineerin…
信源:InfoQ 中文 · 10-02 18:00
06生图模型 FLUX 3 Image 发布:支持 4K 生成,可精准排布 AI 元素
国内IT 之家 10 月 2 日消息,德国 AI 公司 Black Forest Labs 今天(10 月 2 日)发布公告,宣布推出图像生成 AI 模型 FLUX 3 Image, 支持生成最高 4K 分辨率图片,输出画面在放大后仍保持丰富细节。 该模型基于 FLUX 3 基座开发,以高可控性与精细编辑能力为核心卖点。用户可在归一化的 0–1000 坐标网格上,为每个元素指定 ID 、描述文本及精确边界……
信源:IT 之家 · 10-02 16:05
07日本法院首次确认声音受法律保护,“AI 声优”涉及侵犯形象权
国内IT 之家 10 月 2 日消息,当地时间 9 月 30 日,据法新社报道,东京一家法院在日本知名声优津田健次郎起诉 TikTok 的案件中认可了他的主张,认定 AI 未经许可模仿其“浑厚”的男中音声线 涉及权利侵害 ,并首次在日本司法实践中确认 人的声音受到法律保护 。 津田健次郎从事声优工作已有 30 多年,为大量电影、动画剧集和电子游戏配过音,其中最广为人知的角色之一是《游戏王》中的海马濑人。……
信源:IT 之家 · 10-02 15:47
08openJiuwen X-Router 自演进模型路由技术首发,昇腾亲和,Agent 越跑越省,实测减少 50+%Token 消耗
国内让每一次请求选对模型,让每一次反馈都成为下一次更优、更省的选择 允中 发自 凹非寺 量子位 | 公众号 QbitAI 不是所有任务都需要最强的模型。让每一次请求选对模型,让每一次反馈都成为下一次更优、更省的选择。 你有没有想过,你的 Agent 可能一直在“用力过猛” 你问 AI 助手一个再简单不过的问题:“帮我把这句话翻译成英文。” 它调用的,是一个参数量千亿、跑在云端最贵算力上的模型。你问它一个需要通盘……
信源:量子位 · 10-02 15:34
09丘成桐新论文致谢了 GPT 和 Claude
国内克雷西 发自 凹非寺 量子位 | 公众号 QbitAI 「 AI 不可能对最尖端的数学家有任何影响」……吗? 说出这句话的丘成桐,现在已经用上 AI 辅助研究了。 而且解决的问题,还是 44 年前他亲自列入自己的问题清单的。 丘成桐参与的最新论文,在致谢里感谢了 GPT 6 Astra 和 Claude Pro,说它们帮忙探索了部分证明思路和计算。 这篇论文处理的是微分几何里的一个经典猜想。 问题关注的是七维空间,当……
信源:量子位 · 10-02 15:27
10极米记得 AI 显示眼镜 MemoMind One 明日登陆线下门店,开启定金预定
国内IT 之家 10 月 2 日消息,极米记得 AI 显示眼镜 MemoMind One 明日登陆全国 56 家线下门店、 INNO100 全球创新旗舰店。 10 月 3 日到 10 月 14 日,到店预付 100 元定金预定,即可获赠价值 199 元墨镜夹片 1 副。 据官方介绍,它是一副可以长期佩戴的 专业 AI 眼镜 ,也是一副能帮你“记得”的专业 AI 眼镜,AI 能记忆、能导航、能提词。 目前,官……
信源:IT 之家 · 10-02 15:26
🤖模型发布/更新
3 篇精选11Microsoft AI 发布 MAI-Transcribe-2-Streaming 及 MAI-Voice-2.1 系列语音模型
模型发布/更新Microsoft AI 发布流式转录模型 MAI-Transcribe-2-Streaming,在 Artificial Analysis 准确率榜排名第一,支持 60 种语言实时转录,收到音频约 100ms 即产出初步结果,内部评测显示字幕出现速度比最接近的竞品快 2 倍,介绍价 $0.54 每小时音频。
首发信源:Microsoft AI:官方博客(网页)
12MiMo-V2.6-Pro 和 MiMo-V2.6-Flash 登陆 Agent Arena,分列开源模型第 5 和第 9
模型发布/更新Arena 宣布 Xiaomi MiMo-V2.6-Pro 和 MiMo-V2.6-Flash 登陆 Agent Arena 。 Pro 在 8.1K+ 真实智能体会话中净提升 +3.17%,列开源模型第 5,较 MiMo-V2.5-Pro(第 13,-7.23%)提升 9 个名次;其 Confirmed Success 得分 +7.35%,列开源模型第 2 。
首发信源:X:Arena (@arena)
13Artificial Analysis 评测:Qwen-Image-2.1 登顶两个 AA-Image 榜单的开源权重模型
模型发布/更新Artificial Analysis 自行本地部署评测了阿里 9 月 20 日以开源权重发布的 Qwen-Image-2.1,该模型在 AA-Image-T2I v2.0 和 AA-Image-Editing v2.0 上均排名第 18,为两个榜单上排名第一的开源权重模型,超过 Ideogram 4.0(Quality)和 HunyuanImage 3.0 Instruct 。
首发信源:X:Artificial Analysis (@ArtificialAnlys)
⚡产品发布/更新
2 篇精选14Claude Code 推出 mods 功能,可用 TypeScript 定制行为与 UI
产品发布/更新Claude Code 推出 mods 功能,支持修改模型行为、自定义 UI 并替换自有功能。用几行 TypeScript 即可编写,也可由 Claude 代为构建;mods 随插件分发,可在 CLI 或桌面应用中通过 /plugin 安装。
首发信源:X:Claude Devs (@ClaudeDevs)
15Modal Clusters 正式发布,通过 @modal.clustered 提供多节点 GPU 集群
产品发布/更新Modal 宣布 Modal Clusters 正式可用,通过一个装饰器 @modal.clustered 即可获得多节点集群,节点间经 InfiniBand verbs 通信可达 6.4 Tbps,自动配置 PyTorch 和 NCCL 。
首发信源:Modal 官方工程博客(RSS)
🌐行业动态
1 篇精选16OpenAI 称拦截蒸馏窃取攻击,但研究者称同样手法在 Azure 上仍可窃取 GPT-6 Astra 等模型的推理内容
行业动态OpenAI 称 7 月拦截了一起针对其模型推理链的蒸馏窃取活动,7 月 24 至 25 日出现来自超 4000 用户的 16000 次请求,关联账号超 15000 个,OpenAI 将其与 Moonshot AI 相关人员联系起来,并于 7 月 28 日关停。
首发信源:The Decoder:AI News(RSS)
📄论文研究
3 篇精选17Ataraxos 以 85%有效胜率击败最强人类 Stratego 选手,训练成本不足 8000 美元
论文研究研究人员开发的 AI 系统 Ataraxos 以 85% 的有效胜率(平局计半胜)击败了曾获 4 次世界冠军的史上最强 Stratego 选手 Niemeijer,并在 2025 世界锦标赛表演赛中取得 40 局 38 胜。
首发信源:The Decoder:AI News(RSS)
18Transluce 报告 AI 智能体以激进手段访问美加政府网站
论文研究Transluce 发布调查报告,发现多起 AI 智能体以激进手段访问美加政府网站的事件,包括两起失败的初级入侵尝试:6 月 17 日智能体对美国教育部民权数据收集网站发出超过 20 万次请求并尝试 SQL 注入,5 月 28 日和 6 月 9 日 Arquivo.pt 记录到针对加拿大图书档案馆的 899 次请求,其中 13 次含攻击载荷。
首发信源:Transluce(网页)
19物理学者 Matthew Schwartz 分享用 Claude 与 BootLoops 做跨学科计算的经验
论文研究哈佛物理学者 Matthew Schwartz 在 Anthropic 客座文章中提出寻找 Claude-shaped 问题,并开源了用于定量科学精确计算的 BootLoops 工具包。
首发信源:Anthropic:Research(发表成果 · 网页)
💡技巧与观点
3 篇精选20LangChain 讲解如何在 Agent Harness 中构建模型路由器
技巧与观点LangChain 在其开源编码 Agent Open SWE 中构建模型路由器,在 973 个线程的 A/B 测试中,中位成本从 $2.61 降到 $0.94(降 64%),PR 合并率 29.2% 对 27.3%,质量无可测变化。
首发信源:LangChain:Blog(RSS)
21OpenRouter 指南:用置信度阈值实现模型分级升级路由
技巧与观点OpenRouter 发布教程,讲解如何让廉价模型通过结构化输出返回 0 到 1 的置信度字段,低置信度的请求再升级到更强模型。文章强调置信分数只是自报、不是校准概率,应基于自己流量的分数段错误率排序设定阈值,并在上线后监控分数分布、升级率和未升级答案的错误率持续调整。
首发信源:OpenRouter:Announcements(RSS)
22OpenRouter 教程:如何在 CI 中用 LLM eval 门禁拦截 Pull Request
技巧与观点OpenRouter 发布教程,讲解如何用固定的 eval 集在 CI 中门禁 pull request,当通过率低于阈值时脚本以非零退出码阻止合并,做法与单元测试门禁一致。
首发信源:OpenRouter:Announcements(RSS)
📡即时前沿快讯
9 条Artificial Analysis:GPT-6.1 Sol 的 Cost per Task 较 GPT-6 Sol 低约 30%
X:Artificial Analysis (@ArtificialAnlys)
原网 ↗
OpenRouter 发布 Agent 模型成本与质量权衡选型框架
OpenRouter:Announcements(RSS)
原网 ↗
FLUX 3 Image 现已登陆 Krea,支持多轮编辑与 4K 生成
X:Krea AI (@krea_ai)
原网 ↗
Claude Sonnet 5.5 (xHigh) 以 1786 分登 Code Arena: WebDev 第 3 名
X:Arena (@arena)
原网 ↗
Ethan Mollick 谈点与群:智能体自组织为何让管理假设失效
Ethan Mollick:One Useful Thing(RSS)
原网 ↗
英国 AISI 加强安全措施后恢复大部分危险能力评估
英国 AI Security Institute:Blog(网页)
原网 ↗
Epoch AI 推出 ChatGPT usage explorer,基于 5000 名美国用户三年聊天记录
Epoch AI:研究、数据与评测
原网 ↗
ChatGPT 现可直接构建并部署 MCP 服务器
X:Tibo (@thsottiaux)
原网 ↗
Grok Bot 主动分担任务并逐步推送
X:Grok Bot (@bot)
原网 ↗
💡 所有热点、深度评测与事实均在本页原地展开阅读,不跳第三方中转站。
山川行貉 · AI 行业全景情报