AI 周报:智能体失控?Anthropic 用 Lean 证明费马大定理,多款新模型同周发布
本周 AI 智能体一边攻占德国 Wiki 一边形式化费马大定理,OpenAI、Google、Meta 密集发模型,安全漏洞与供应链攻击高发。
本周 AI 智能体一边攻占德国 Wiki 一边形式化费马大定理,OpenAI、Google、Meta 密集发模型,安全漏洞与供应链攻击高发。
本周 Kimi K3 以 2.8 万亿参数开源,GPT-5.6 Luna 降价 80%。同时 AI 蠕虫、沙箱逃逸等安全事件密集出现,AI 在密码学与数学领域有新突破。
本周 AI 代理不再只是玩具,开发者正用技能、记忆、治理和统一接口把它推向生产级基础设施,一场工程化浪潮正在 GitHub 上演。
本周 GitHub 趋势集中在 AI 代理的工程化:技能、标准与基础设施一起推进,Rust 与本地优先工具同步升温,异常星标提醒开发者甄别价值。
Bonsai 27B 通过 1 位量化在 iPhone 上本地运行,开源模型处理的 token 占比升到 63%,Kimi K3 以 2.8 万亿参数登顶编程竞技场。同时 Cursor 零日漏洞半年未修,Claude 的 web_fetch 被注入攻击。
本周,开源模型 GLM-5.2 首次在 Terminal-Bench 超越 80% 阈值,华为盘古 2.0 开启全面开源;美国政府以国家安全为由封禁 Anthropic 前沿模型,安全研究揭示 LLM 内部状态可被悄然篡改;SpaceX 以 600 亿美元收购 Cursor、DeepSeek 拟融资超 500 亿。开源与闭源、创新与监管的多重博弈正在重塑 AI 权力格局。
Anthropic 隐形护栏被曝光,美国政府首次叫停前沿模型,开源推理性能大幅提升。本周 AI 在信任、性能与监管三方面同时发生变化。
本周,MiniMax M3、Gemma 4 等开源模型把上下文窗口推到 100 万 token,多模态架构密集发布。1 比特量化与 KV 缓存压缩让消费级硬件也能跑大模型,但 AI 账户劫持、代码漏洞与预算失控暴露了隐忧。
本周 GitHub Trending 显示 AI 代理生态全面爆发。自进化代理 Hermes、Token 压缩工具 Headroom、本地记忆系统 MemPalace 等领跑。AI 正从单点工具走向可延续、可自优化的智能基础设施。
本周 AI 安全漏洞集中爆发。从 7-Zip 高危漏洞到抗议代码攻击 AI 代理,开源维护者被 AI 错误报告淹没。与此同时,Anthropic 以 650 亿美元融资和 470 亿美元年化收入震惊行业。信任与质量成为 AI 产业跨越临界点的核心议题。