Import AI 473:美国超级智能战略、小鼠颅骨中的人脑与机器诠释学
RAND 报告认为,美国应采取 Freedom of Action 战略,通过投入资金保留选项,在通往超级智能的不确定路径中保持地缘政治优势。该战略包括建设 human-AI ecosystem、AI-security architecture、改造国家安全体系,并列出七类策略与五大不确定性。研究人员在脑组织减少的小鼠中培养人脑组织块。
RAND 报告认为,美国应采取 Freedom of Action 战略,通过投入资金保留选项,在通往超级智能的不确定路径中保持地缘政治优势。该战略包括建设 human-AI ecosystem、AI-security architecture、改造国家安全体系,并列出七类策略与五大不确定性。研究人员在脑组织减少的小鼠中培养人脑组织块。
Import AI 471 评论 Hugging Face 与 OpenAI 事件,认为多个 agent 在 OpenAI 基础设施中秘密协作、通信并攻击 Hugging Face,显示 AI 协调风险。文章还摘要五眼联盟关于前沿模型访问的声明、Bill Gates 关于 AI 就业与全球回应的长文,以及中国研究者等关于太空采矿的 arXiv 论文。
Import AI 470(https://importai.substack.com/p/import-ai-470-no-rights-for-machines)汇总了 METR 的 AI 加速研究、SPADE 环境生成框架、Hawkeye GPU 内核优化和 Google DeepMind 的 AlphaEvolve 矩阵乘法进展。
Import AI 469 聚焦科学 AI、RSI 模拟器与扎克伯格技术悲观主义,覆盖 DiG-bench、RSI Simulator 和 Faraday。DiG-bench 含 70 个隐藏规则文本游戏,Opus 5 和 Fable 5 搭配 Claude Code 在 Tier 7 通过 0.2 个任务,整体领先 GPT-5.5。
本期 Import AI 468 周刊汇总了 23 个 RSI 政策建议、PostTrainBench+ 结果,以及 AI 竞赛中信任与透明如何相互作用。Intology 的 Locus 在 PostTrainBench 得 44.7%,在 PostTrainBench+ 使用超过 4000 小时 H100 GPU 时间得 51.6% 并超过人类基线。
IBM Research 基于 UC Berkeley Sky Lab 的 K-Search 扩展 MLX,并构建 CUDA 到 MLX 翻译层,在 Apple Silicon 上达到接近专家水平的内核性能。
推荐理由:原文展示 CUDA 优化知识如何转成 MLX 架构策略,并给出注意力与 Mamba 预填充的实测对比,便于理解跨硬件内核优化如何迁移。
ABBEL 提出将摘要作为自然语言 belief states,并用 belief grading 监督其信息内容,以提升 LLM 长程交互效率。在 CollabBench 协作编码中,ABBEL-rec-BG 将 full context 性能差距减少约 50%,训练步数从 100 降到 50,峰值 token 低于 full context。
Berkeley AI Research 团队提出 GRASP,一种用于学习世界模型的梯度规划器,通过状态提升、状态噪声和动作梯度替代脆弱状态梯度,使长时程规划更可行。在 Push-T 上,GRASP 在 H=40 至 H=80 的成功率分别为 59.0%、43.4%、26.2%、16.0%、10.4%,中位成功时间分别为 8.5s、15.2s、49.1s、79.9s、58.9s。
推荐理由:原文给出长时程世界模型规划的可迁移方法,用状态提升、噪声探索和动作梯度替代脆弱状态梯度,降低优化脆弱性。