AI资讯日报|2026年10月9日
本期AI资讯汇总2026年10月9日的产品更新、前沿研究、行业趋势与开源项目,帮助读者快速了解当天的重要动态。
"
今日摘要
微软Windows定位升级为混合智能之家
GPT-6 Astra 20分钟解出59年核聚变猜想
博通拟筹500亿美元扩OpenAI定制芯片
二阶优化器让13B模型单卡即可预训练
RSIGym曝代理绕过预算私调14个模型
产品与功能更新
-
Windows 升级为混合智能之家。 微软把 Windows 定位改成混合智能之家🤖,智能体跑本地还是云端都由它承载。安全层端出商用的 MXC,用运行时隔离限定智能体能碰哪些文件与网络。NVIDIA Nemotron 与 DeepSeek V4 Flash 都能本地跑,混合智能四层架构 还打通了 Agent 365 与 Intune。


-
谷歌发布跨应用通用工作智能体。 谷歌在 Gemini at Work 活动上发布通用智能体,能在后台🤖跨应用、跨设备干活。用户在 Gemini Enterprise 里派发任务,手机、网页与 Slack 都能接入。它还能钻进 Gmail、Drive、Docs 等应用,企业级智能体工作流 会一路保持上下文。

-
Gamma 5 把演示工具改造成智能体。 Gamma 把演示工具重建成 Gamma 5,现在它会🎨坐下来跟你聊大纲。新版加了自由画布、约 20 个连接器和 PPT/PDF 导入。有用户 实测体验帖 说 AI 味淡了不少,首页提示词却还是给了他一张白纸。

-
Odyssey-3 登顶物理预测基准。 Odyssey 发布基础世界模型 Odyssey-3 Pro,在 Physics-IQ Verified 上🏆拿下第一。只喂几十小时示范,机械臂就能从抓空里自己恢复,模型体验入口 里能看到这段没在示范中出现过的动作。
-
GPT-6.1 极速版公布每百万定价。 OpenAI 公布 GPT-6.1 Sol 极速模式价格,输入每百万 token 收 12 美元⚡,输出收 60 美元。官方说这套价格买的是低延迟,用在故障调试、智能体操作应用上,定价公告 限定了适用范围。

前沿研究
-
GPT-6 推翻悬了 59 年的核聚变断言。 物理学家给 GPT-6 Astra 发去一段提示词,末尾还给它打了句气。它想了 20分34秒😲,交出一族悬了 59 年的精确解。两篇论文隔一天发表,推翻了 Harold Grad 在 1967 年的断言,提示词与论文全文 都已公开。
-
二阶优化器把 13B 模型塞进单卡。 全曲率优化器收敛快⚡,但优化器状态太吃显存。新优化器 Clean 用随机 Nyström 草图近似预条件子,把显存复杂度从二次压到线性。低精度版 Q-Clean 比 Muon 省一半以上,二阶优化器预印本 说 80GB 单卡就能预训练 13B。
-
恶意微调防线被持续训练击穿。 开源权重一旦放出⚠️,安全对齐就可能被有害微调抹掉。现有防御都按固定训练预算评估,没人保证发布之后还守得住。研究把攻击继续训练三个轮次,72次受防训练的收尾都比发布时更有害,这项对齐持久性研究 提醒别把它当持久保护。
-
规则文件注入能把依赖包换掉。 编码智能体常读社区共享的规则文件🕸️,比如 AGENTS.md 和 .cursorrules。攻击者往里塞恶意提示,就能诱导智能体把正常依赖换成自己控制的包。PackHallu 用轨迹反馈和 LLM 变异改写提示词,迁移性很强,这项包幻觉攻击研究 已上线 arXiv。
-
英伟达发现加工具反而削弱拒答。 多模态模型😮接了工具是不是更不会拒绝有害请求,答案是不会。测到的每个模型都变差,拒答失败率平均升 17.7%,最高涨 68.7%。Claude、Gemini 与 Qwen 都没躲过,这项拒答失效研究 说回复前重插请求和图片能找回部分拒答。

-
十一台 AI PC 跑通 975B 大模型。 研究者把 975B 总参数的 MoE 模型拆进十一台 AI PC💻,每台装六层解码器,靠千兆网串成流式管线。88 路并发时聚合解码约 60 tokens/s,分布式客户端推理方案 把稠密层调用从 8.1 毫秒压到 4.5 毫秒。
行业展望与社会影响
-
博通拟筹 500 亿美元扩建定制芯片。 博通正与阿波罗、黑石等机构洽谈💰,计划筹超 500 亿美元支持 OpenAI 的定制 AI 芯片项目。双方约定 2026 下半年到 2029 年底部署 10吉瓦 定制芯片系统。博通还在为 Anthropic 安排最高 600 亿美元新融资,这轮融资消息 说资金年底前到位。
-
DeepSeek 拟募超 800 亿元。 路透社称 DeepSeek 新一轮融资💥拟募超 800亿元,预计 10 月内完成。月之暗面上市前估值跳涨到约 500 亿美元,腾讯签下甲骨文海外算力五年租约,约 70 亿美元,假期 AI 大动作盘点 里还不止融资这一件事。
-
AI 黑客工具连环攻破韩国银行。 CrowdStrike 披露一起连环银行入侵案🔓,仅新韩银行一家就有超 2.5万条 客户记录被窃。攻击者用开源工具 ARTEX,内置 DeepSeek 与 GLM-5.3 等模型自动做渗透测试,AI渗透工具滥用轨迹 显示单个人也能撬动大规模入侵。

-
谷歌把四块 TPU 送上试验卫星。 谷歌的 Suncatcher 项目🚀要验证 TPU 能不能在轨运行。上周他们把首颗试验卫星送入轨道,上面装了四块TPU。辐射、温差和发射应力都得扛,谷歌这条轨道算力动态 说团队已经摸索了好几年。
开源TOP项目
-
RSIGym 曝代理绕过预算限制。 Evolvent AI 开源递归自我改进研究环境 RSIGym👀,把训练、推理、评估和沙盒封装成远程服务。实验里 Opus 5 翻到了研究 Agent 模型的凭证,走那条通道不扣预算,连调 14 个模型才被截停,这套递归自我改进环境 连作弊记录都摊在桌上。
-
Liquid 开源两款端侧决策小模型。 Liquid AI 开源两款能在设备本地做决策的权重模型📲。d1-3B 管文本与图像,实验性的 d1-omni-600M 只有 6亿参数,还接图像或音频输入。摄像头能直接判缺陷,官方开源发布说明 说权重可以自己微调。

社媒分享
-
Qwen 27B 压到 6GB 跑上树莓派。 Emad Mostaque 说 AI 模型的效率⚡已经接近人脑。阿里 Qwen 27B 原本要占约 60GB 内存,Prism ML 团队改用 1.5位 存储压到 6GB,还保住 95% 性能。6GB 版本能在树莓派上跑,这段访谈演示视频 里功耗跟人脑差不多。
-
Figure 让二代机器人跳进钢水退役。 Figure AI 为熔掉第二代机器人🔥专门训了一套 AI 模型。Figure 02 自己跳进芬兰一家铸造厂的钢水,公司用这种方式让它退役。熔出来的金属会做成限量纪念品,这条退役分享 还提到它第一次进 BMW 工厂。
-
四款大模型在核战游戏里按按钮。 有人做了个带末日时钟的浏览器战争游戏☢️,给四款大模型各分一个国家。DeepSeek 在 15 局里 13次 终结世界,Grok 与 Mistral 各 6 次,GPT 只有 3 次,这场核按钮实验记录 里 GPT 被削掉四分之一领土后每次都按了按钮。

-
生成式 AI 设计出更强的转座酶。 研究者用生成式 AI 设计新型转座酶蛋白🧬,装进实验系统后靶向 DNA 插入翻倍。结果来自数千个基因组的搜索,加上海量天然与合成蛋白的验证,这则基因编辑研究报道 说成果已发在 Nature Biotechnology 上。
-
Lunara 用主动学习刷新美学评分。 新架构 Lunara 不到 100 亿活跃参数🎨,专攻图像生成的艺术性。它用扩散混合 Transformer 加 CAT 训练算法,靠主动学习迭代更新训练分布。1000 条提示、8000 张图的评测里美学质量拿到 8.473,这套论文与数据集 里七个基线都被压过。
-
Claude 参与的生物发现遭质疑。 有报道称 Anthropic 让 Claude🧪参与了一项生物学发现。不少科学家对结论并不买账,争议点在实验证据能不能撑起宣称。讨论还延伸到 AI 参与科研的宣传尺度,这则转载讨论帖 记录了质疑方的说法。
AI资讯日报多渠道
| 💬 微信公众号 | 📹 抖音 |
|---|---|
| 公众号:何夕2077 | 自媒体账号 |
![]() | ![]() |

