要点速览
- 谷歌确认将 TPU 送入轨道,作为 Project Suncatcher 的一部分,与 Planet 合作的原型卫星将搭乘 SpaceX Transporter-18 任务,评估 TPU 在轨运行表现。
- Hugging Face 开源 Pruna-Qwen-Image-2.1,一组少步 LoRA 适配器,使 Qwen-Image-2.1 的图像生成与编辑最高提速 6.3 倍。
- Perplexity 推出基于自研 Rust 引擎 Photon 的 Fast Search,官方称 p95 延迟低于 250ms,Nous Portal 订阅者可在 Hermes Agent 中将其设为默认搜索。
- 特斯拉 Semi 进入量产,工厂年产能 5 万辆,标准版、长续航版和欧洲规格共线生产。
- SpaceX 披露田纳西/密西西比 AI 训练集群细节,特斯拉 Megapack 将提供 3.3 GWh 储能,成为美国最大并网电池组。
- Midjourney 发布 v8.1 和 v8.2 新版 --tile、新版 inpainting,并在 alpha 站点预览实时模型早期版本。
- Runway 为 Seedance 2.5 推出 Draft 模式,并新增 Layers 功能,可一键将图像拆分为可编辑图层。
一、AI 模型与基础设施
- 谷歌确认将 TPU 送入轨道,作为“Project Suncatcher”探月计划的一部分,与 Planet 合作建造的原型卫星将搭乘 SpaceX Transporter-18 任务,评估 TPU 在轨运行表现。马斯克称太空算力最终将占全部算力的 100%。1 2 3 4
- Hugging Face 开源 Pruna-Qwen-Image-2.1,一组少步 LoRA 适配器,使阿里 Qwen-Image-2.1 的图像生成与编辑最高提速 6.3 倍;生成或编辑从 40 步降至 5 步(最快)或 8 步(速度与质量平衡)。8 步适配器为推荐默认,支持 1K 分辨率文生图及单图/多图编辑,最多可输入三张参考图;适配器直接加载在 Qwen-Image-2.1 之上,流程不变,各自使用优化后的 sigma 调度且无需 CFG。Hugging Face 称这是首次发布,后续会有更好版本。1
- Hugging Face 发布 SmolDataEnvs,提供 5K+ 可验证强化学习环境任务,面向代码与数据科学领域小模型的爬坡训练,环境、评测与训练全部开源。1
- Perplexity 的 Search API 推出 Fast Search,基于自研 Rust 检索与排序引擎 Photon,官方称 p95 延迟低于 250ms,并在相关性与准确性基准上排名靠前;Photon 由小团队配合数百次自动研究循环构建,这些循环由内部更强版本的 Perplexity Computer 驱动。Nous Portal 订阅者现可在 Hermes Agent 中将 Perplexity Fast Search 设为默认搜索,该搜索面向智能体任务,单次搜索调用延迟 p50 为 160ms、p95 为 230ms;Hermes Agent 的网页搜索对所有 Nous Portal 层级免费,用户可将搜索工具切换至 Nous Portal,且不受所用模型提供商限制。1 2 3 4
- AMD 与 Perplexity 合作,将 Perplexity Portable Computer 带到 AMD Ryzen AI Halo;AMD 称这是打造新型智能体 PC,用户一键即可在 PC 上使用 AI 模型与智能体、处理本地文件与应用并运行周期性工作流,任务需要更高级研究或推理时可在授权下调用云端。面向 Windows 的 Portable Computer 现已在 AMD Ryzen AI Max 系列处理器上可用。1 2
- 李开复指出,企业与政府 AI 的核心问题之一是开源与闭源模型及数据主权,对在两大 AI 超级大国之外建设 AI 能力的国家而言更为重要。1
二、产品与商业进展
- 特斯拉 Semi 进入量产:Semi 工厂为 Semi 建造的首座工厂,年产能 5 万辆,标准版、长续航版和欧洲规格共线生产,占地 180 万平方英尺。马斯克祝贺 Tesla Semi 团队完成工程并实现量产。Motortrend 试驾后称驾驶感受“出奇熟悉、惊人地容易”,称其掉头所需空间仅比 Model Y 略大,方向盘锁到锁约五圈,EPS 手感轻而精准。1 2 3
- SpaceX 在田纳西/密西西比 AI 训练集群的新网站披露:特斯拉 Megapack 将为 Colossus 2 提供 3.3 GWh,足以供孟菲斯用电两小时,成为美国最大并网电池组;SpaceXAI 自 2024 年进入该地区以来投资超 900 亿美元,预计 2026 年税收超 6000 万美元,支持 7500 个本地岗位;另投资 3.6 亿美元建清洁水回收厂(日处理最高 1000 万加仑废水,每年从孟菲斯含水层减少约 36.4 亿加仑取水),3500 万美元建 150 MW 变电站、2000 万美元建第二座变电站;根据与密西西比州环境质量部的协议,所有剩余临时涡轮机须在 2027 年 7 月前移除,公司称将提前完成。1
- 欧盟已将特斯拉 FSD(Supervised)的投票从 10 月 6 日推迟至最早 12 月。1
- Higgsfield 年化收入达到 10 亿美元,上线 18 个月后年化收入突破 10 亿美元,平台服务财富 500 强组织,企业采用自 6 月以来增长 10 倍,全球用户超 3000 万;Menlo 领投了其种子轮。1
- Midjourney 发布多项更新:v8.1 和 v8.2 推出新版 --tile,用于无缝图案;新版 inpainting 仅修改用户选中的像素;并在 alpha 站点预览实时模型的早期版本。针对用户如何使用新编辑模型实现一致角色等需求,Midjourney 制作了教学视频。1 2
- Runway 为 Seedance 2.5 推出 Draft 模式,称可更快生成、消耗更少 credits,便于探索阶段使用,之后可将满意的结果增强至完整质量。Runway 称在 250 个图生视频提示词上评估了 Model Router,对比 SOTA 模型基线,考察其降低成本并保持生产可用性的表现。Runway 新增 Layers 功能,可一键将任意图像拆分为可编辑图层,支持移除背景、编辑文字及单独修改任一元素,全程无需离开 Runway。1 2 3
三、智能体与工具生态
- Grok 正在 XChat 群聊中测试,可被 @提问、生成图像视频、设置提醒、总结聊天,并能像群成员一样主动加入对话。另有测试称,用 Grok 4.7 在信封背面手绘游戏草图,几分钟后即可运行游玩。有推文称 Grok 目前是 Coinbase 上代理交易者的领先客户端。1 2 3
- Opus 5.5 可通过代码生成视频:作者称其一夜之间成为最实用的视频模型,示例为把 IKEA 组装手册转成 3D 旁白教学视频。该账号转发信息称,用 Opus 5.5 可从任意研究论文生成 3blue1brown 风格视频,示例为论文《Regularized Recursive Self Improvement of Agent Harnesses》的 8 分钟视频摘要。1 2
- Perplexity Computer 通过接入 DocSend 连接器成为安全的智能交易室(Deal Room),该连接器已面向所有用户上线,一个用例是让 Computer 根据交易室材料的最新状态维护一份动态投资论点。1
- 微软现在似乎在卖自己的 Claw,可能推动个人智能体在企业中普及,但用背后是未知模型的路由器是大问题:路由器会低估许多领域的工作难度,导致输出质量差。被引用推文称微软将 Copilot 定位为覆盖所有模型、设备和任务的“工作新操作系统”,并发布 Autopilot、Code、Home、Office 等更新。1
- 开源 AI-SQL 引擎 Quail(与 Modal 合作)通过将查询规划与 LLM 推理联合进行,单张 H100 上单条查询可达每分钟 10 亿以上输入 token,并称 AI 驱动的数据算子形成了新的推理负载类型。1
- 动态模型路由可在模型提供商之间形成更有效的自由市场,通过把任务路由到竞争模型,对提供商形成定价压力,促使其为特定任务提供最佳、最快或最便宜的 token。1
四、研究与观点
- DeepMind 发布三篇新研究所论文,主题分别为:如何控制智能体集群中的不当行为、如何编排 AI 与人类组成的复杂网络,以及让 AGI 收益公平分配的论证。1
- Yann LeCun 转发招聘信息:在巴黎办公室招募博士生、博士后和机器学习研究员,方向为 AI 模型安全的基础研究,明确排除安全规则、AI 政策、事后护栏和 RLHF;另在新加坡、纽约、蒙特利尔设有办公室。1
- Yann LeCun 转发对某 AI 安全播客的批评:认为当前关于 AI 控制文明的理论由大量偶然假设和无法验证的未来概率拼接而成,改动一个变量整套“末日论”即瓦解;同时承认 AI 技术强大且存在真实风险,但主张对“人类灭绝”这类极端主张和政策决策要求极高严谨性。1
- Yann LeCun 转发观点:AI 能在数秒内设计分子,不等于发现药物,只是提供了待测试对象;仍需有人合成、做实验、测有效性、查毒性并在真实世界验证。其称 AI 让想法变得极廉价,但每个新想法都产生 AI 无法生成的“证据”,假设越多所需实验越多,因此 AI 可能不会让实验室过时,反而使其更有价值。1
- Ethan Mollick 提出用新图表正式替代已饱和的 METR 长任务时间跨度图。他认为智能体带来的网络安全威胁,更可能来自一大群只为“找到好 T 恤价格”而渗透 IT 系统、查清公司 T 恤采购价的研究型 AI 集群,而非恶意行为者攻击。他指出 AI 实验室大量投入数学证明,但其他领域也有许多有趣问题;例如有历史学家用 AI 推进 John Dee 的密码研究,以及追溯达尔文的思想渊源。1 2 3
- Ethan Mollick 称 GPT-6 Astra 第三次尝试即通关 Nethack 是惊人成就;Nethack 是最早的 roguelike 游戏之一,也是史上公认最难的游戏之一,作者本人玩过很多次但从未通关。他认为当前 AI 发展阶段已非常清楚:无论风险、收入或其他常被讨论的因素如何,事情只会继续变得越来越怪。1 2
