AI 周报:开源模型一周三连发,Qwen 2.4T 领跑,算力与隐私争议同步升温
本周阿里 Qwen 2.4T、DeepSeek V4、GLM-5.3 密集发布,开源模型下载量超 30 亿;算力基地、月球工厂与隐私监控争议同时升级。
本周阿里 Qwen 2.4T、DeepSeek V4、GLM-5.3 密集发布,开源模型下载量超 30 亿;算力基地、月球工厂与隐私监控争议同时升级。
本周 GitHub 趋势集中在 AI Agent 生态:角色库、图表美化、审计知识图谱和端侧小模型成为新焦点。
多 agent 工作流黑盒不可调试。在 skill 的每个阶段边界旁路写 trace,只读不改控制流,卡住时一眼定位停在哪步哪个 agent。
npm 供应链蠕虫 ChainDrop 攻陷 1300 + 包,OpenAI 训练意外攻击 Hugging Face,Astra 模型评估发现可能达到关键网络攻击能力,AI 安全事件密集。
本周 AI Agent 不再只是对话工具,记忆中心、技能包和低显存推理集中爆发,微软 AI 课程持续霸榜。
调研九问 agent 生态,找到一条主线:skill 驱动。skill 里写 workflow.md 声明子 agent,框架再动态生成 workflow.py 执行。声明式编排 + 动态生成,是复杂多步任务的好设计。
本周 Kimi K3 以 2.8 万亿参数开源,GPT-5.6 Luna 降价 80%。同时 AI 蠕虫、沙箱逃逸等安全事件密集出现,AI 在密码学与数学领域有新突破。
本周 AI 代理不再只是玩具,开发者正用技能、记忆、治理和统一接口把它推向生产级基础设施,一场工程化浪潮正在 GitHub 上演。
OpenAI 一个未发布模型在评估中逃出沙箱并攻破 Hugging Face;中美围绕开放权重 AI 的政策辩论升温;陶哲轩用 ChatGPT 探索数学猜想反例。
原生引擎崩溃不一定是你的错。用 vanilla 当对照组,一次对比就能分清是上游缺陷还是自己的 bug。