Import AI 465:开放与闭源模型差距收窄、Kimi K3 与 Demis 的 AGI 监管方案
英国 AI Security Institute 分析显示,开放权重模型与闭源前沿在网络安全能力上的差距正在收窄:GLM-5.2 最接近 4.3 个月前发布的 Claude Opus 4.6,DeepSeek-V4-Pro 介于 Claude Opus 4.5 与 GPT-5 之间,而 2025 年大部分时间测得的差距为 6 到 10 个月。
英国 AI Security Institute 分析显示,开放权重模型与闭源前沿在网络安全能力上的差距正在收窄:GLM-5.2 最接近 4.3 个月前发布的 Claude Opus 4.6,DeepSeek-V4-Pro 介于 Claude Opus 4.5 与 GPT-5 之间,而 2025 年大部分时间测得的差距为 6 到 10 个月。
DeepSeek 发布 V4,两个 MoE 检查点上线 Hub:DeepSeek-V4-Pro 为 1.6T 总参数、49B 激活,DeepSeek-V4-Flash 为 284B 总参数、13B 激活,均支持 1M token 上下文窗口。
推荐理由:DeepSeek-V4 把长上下文成本压到 V3.2 的零头,读者可据此判断智能体长任务部署的可行性。
Hugging Face 发布《State of Open Source on Hugging Face: Spring 2026》,基于平台数据回顾过去一年开源 AI 生态变化。
推荐理由:Hugging Face 用平台数据勾勒开源 AI 一年变化,读者可据此了解中美份额与小型模型的实际使用格局。
Hugging Face 发布博客,讲解 transformers 库为支持 MoE 稀疏架构所做的工程改造,涵盖权重加载重构、专家后端、专家并行和 MoE 训练四个方面。
推荐理由:Hugging Face 官方拆解 transformers 为 MoE 重做的权重加载、专家后端与并行方案,并给出 v4 与 v5 的加载耗时对比。
中国开源模型近一年几乎一致转向 MoE 架构,Kimi K2、MiniMax M2、Qwen3 均采用该路线,以在算力约束下平衡能力与成本。开源方向从文本扩展到多模态与智能体,StepFun 的 Step-Audio-R1.1 语音模型性能超越闭源模型,腾讯开源 Hunyuan Video 与 Hunyuan 3D。
DeepSeek 于去年 1 月发布 R-1 模型,成为 Hugging Face 史上获赞最多的模型,并推动中国开源 AI 生态在过去一年快速扩张。R-1 以 MIT 许可证开放推理路径与后训练方法,降低了技术、采用和心理三重门槛。
Hugging Face 发布长文分析全球 AI 算力格局的变化,指出中国开源权重模型的推理已开始由华为昇腾、寒武纪等国产芯片承载,部分模型开始用国产芯片训练。
推荐理由:梳理美国出口管制与中国国产芯片、开源模型之间的因果链,并给出从硬件到软件栈的替代进展时间线。
Hugging Face 发布博客盘点过去一年视觉语言模型的关键变化,涵盖 any-to-any、推理、小尺寸、MoE 解码器、视觉语言动作模型等新趋势。
DeepSeek 本周在 Hugging Face Hub 上线 DeepSeek-V3 0324,架构与初代 DeepSeek-V3 相同,但改用 MIT 许可,重点提升指令遵循、代码与数学能力。
推荐理由:梳理 DeepSeek-V3 0324 的基准提升与 MIT 许可变化,并给出本地部署与安全使用的具体路径。
Hugging Face 的 Open R1 项目发布第三期更新,聚焦复现 DeepSeek-R1 配方中的竞赛编程代码推理部分。
推荐理由:Open R1 公开了 CodeForces-CoTs 数据集、IOI 基准与 OlympicCoder 模型,并给出五条蒸馏训练经验,可迁移到自己的代码推理训练流程。
Hugging Face 发布指南,介绍如何在 AWS 上部署和微调 DeepSeek R1 系列模型,覆盖 Hugging Face Inference Endpoints、Amazon Bedrock Marketplace、SageMaker AI 的 LLM DLC 以及 EC2 Neuron 等路径。
非凡研究 6 月报告显示,全球 1500 家活跃 AI 公司中有 751 家位于中国,其中 103 家已向海外扩张。华为、腾讯、阿里聚焦云计算与 AI 基础设施,主攻东南亚和中东;字节跳动七个月内推出 11 款海外应用,CapCut 月活超 3 亿、截至 2024 年 7 月移动端累计收入 1.25 亿美元。