Import AI 473:美国超级智能战略、小鼠颅骨中的人脑与机器诠释学
RAND 报告认为,美国应采取 Freedom of Action 战略,通过投入资金保留选项,在通往超级智能的不确定路径中保持地缘政治优势。该战略包括建设 human-AI ecosystem、AI-security architecture、改造国家安全体系,并列出七类策略与五大不确定性。研究人员在脑组织减少的小鼠中培养人脑组织块。
RAND 报告认为,美国应采取 Freedom of Action 战略,通过投入资金保留选项,在通往超级智能的不确定路径中保持地缘政治优势。该战略包括建设 human-AI ecosystem、AI-security architecture、改造国家安全体系,并列出七类策略与五大不确定性。研究人员在脑组织减少的小鼠中培养人脑组织块。
Import AI 470(https://importai.substack.com/p/import-ai-470-no-rights-for-machines)汇总了 METR 的 AI 加速研究、SPADE 环境生成框架、Hawkeye GPU 内核优化和 Google DeepMind 的 AlphaEvolve 矩阵乘法进展。
IBM Research 基于 UC Berkeley Sky Lab 的 K-Search 扩展 MLX,并构建 CUDA 到 MLX 翻译层,在 Apple Silicon 上达到接近专家水平的内核性能。
推荐理由:原文展示 CUDA 优化知识如何转成 MLX 架构策略,并给出注意力与 Mamba 预填充的实测对比,便于理解跨硬件内核优化如何迁移。
ABBEL 提出将摘要作为自然语言 belief states,并用 belief grading 监督其信息内容,以提升 LLM 长程交互效率。在 CollabBench 协作编码中,ABBEL-rec-BG 将 full context 性能差距减少约 50%,训练步数从 100 降到 50,峰值 token 低于 full context。
Berkeley AI Research 团队提出 GRASP,一种用于学习世界模型的梯度规划器,通过状态提升、状态噪声和动作梯度替代脆弱状态梯度,使长时程规划更可行。在 Push-T 上,GRASP 在 H=40 至 H=80 的成功率分别为 59.0%、43.4%、26.2%、16.0%、10.4%,中位成功时间分别为 8.5s、15.2s、49.1s、79.9s、58.9s。
推荐理由:原文给出长时程世界模型规划的可迁移方法,用状态提升、噪声探索和动作梯度替代脆弱状态梯度,降低优化脆弱性。