AI 周报:开源模型一周三连发,Qwen 2.4T 领跑,算力与隐私争议同步升温
开源模型这周很挤。
阿里、DeepSeek、智谱、小红书都发了新模型。
先看最重的 Qwen。
开源模型混战
graph TD
A[阿里 Qwen 家族] -->|开源权重| B[Qwen3.8-2.4T]
A --> C[Qwen 3.8 27B]
D[DeepSeek] --> E[V4 Pro 0813]
F[智谱 Z.ai] --> G[GLM-5.3]
H[小红书] --> I[dots3-note]
B & C & I --> J[Hugging Face 下载]
E --> K[OpenRouter API]
G --> L[Z.ai 平台]Qwen3.8-2.4T-A95B 是阿里最大的开源模型,总参数 2.4 万亿、激活 950 亿。MoE 架构(混合专家,指每次推理只激活部分参数的模型)让它在保持大参数的同时控制推理成本。社区反馈推理能力强,但 token 消耗约为对比模型的 5 倍,耗时偏长。同周还发了 Qwen 3.8 27B 密集模型,支持 MTP(多 token 预测,一次生成多个 token 加速推理),在 RTX 5090 上搭配 ninfer 可达约 138 tokens / s。
DeepSeek V4 Pro 0813 紧随其后。这是 DeepSeek V4 系列的升级版,在 OpenRouter 上线 API。社区测试显示编程和推理都有提升,价格继续压低。
智谱的 GLM-5.3 也在本周发布,主打编程能力和网络任务。小红书则开源了 dots3-note,280B MoE 仅激活 16B—— 激活参数远小于总参数,意味着推理时只跑一小部分,本地部署友好。
pie title 本周开源模型激活参数对比
"Qwen3.8-2.4T (激活950B)" : 950
"dots3-note (激活16B)" : 16
"Qwen3.8-27B (密集)" : 27开源模型在 Hugging Face 的累计下载量已超 30 亿。这个数字说明,开源不再是」廉价替代」,而是很多团队的首选。
算力与资本:钱往哪里走
高盛本周参与英伟达、英特尔和 Alphabet 的大型 AI 融资交易。伯克希尔二季度增持 Alphabet 至第三大重仓,结束连续净卖出。华尔街在用真金白银押注 AI 基础设施。
但算力供给也在变复杂。苹果联手阿里为中国市场训练专属 AI 大模型,有望成为首个获批的外企。这说明地缘政治正在把全球 AI 拆成多个区域性生态。数据主权和合规,成了和模型能力同等重要的选型维度。
安全与隐私:漏洞和监控并行
PostgreSQL 修复了 to_char 函数的高危漏洞,可致任意代码执行。to_char 是把数据格式化成字符串的函数,漏洞意味着攻击者能通过精心构造的输入在数据库服务器上执行命令。用了 PostgreSQL 的团队建议立刻升级。
Tailscale 披露数据库损坏事件。虽然定位是内部事故而非外部攻击,但暴露了零信任网络工具的数据持久化风险。
浏览器侧,Firefox 成为最后仍支持 uBlock Origin 的主流浏览器。Chrome 推出新版 Manifest V3 限制广告拦截能力后,uBlock Origin 这类广告拦截器的核心功能受限。隐私和广告之间的博弈,正在从产品层蔓延到浏览器内核。
本周小结
三条主线:开源模型密集发布、资本继续押注算力、安全与隐私问题没有放慢。
开源这周很挤,但要注意 token 消耗和实际部署成本 —— 参数大不等于便宜。资本流向说明 AI 基础设施仍是华尔街的共识。安全方面,PostgreSQL 漏洞和 Tailscale 事故提醒:用 AI 的同时,传统基础设施的安全债不能欠。
下周值得盯:Qwen3.8-2.4T 的实际部署反馈、DeepSeek V4 Pro 的价格会不会引发新一轮降价、苹果 - 阿里的中国专属 AI 能否获批。
参考资料
- Horizon Daily AI 技术日报(2026-08-10 至 2026-08-15):https://thysrael.github.io/Horizon
- Qwen3.8 系列 HuggingFace 页面:https://huggingface.co/Qwen
- DeepSeek V4 Pro 0813:https://huggingface.co/deepseek-ai
- 智谱 GLM-5.3 发布:https://www.zhipuai.cn
- PostgreSQL to_char 漏洞公告:https://www.postgresql.org/support/security/
- Tailscale 事故回顾:https://tailscale.com/blog