跳到正文

模型发布

新模型的发布、开源与迭代:大模型厂商的旗舰更新、开源权重放出、性能与价格变化的第一时间记录。

198条精选相关主题产品更新论文研究开源生态

最新精选

第 121–140 条 · 共 198 条
5月21日周三
  1. Mistral AI73

    Mistral AI 发布智能体编码模型 Devstral,Apache 2.0 开源

    Mistral AI 与 All Hands AI 合作发布面向软件工程任务的智能体 LLM Devstral,以 Apache 2.0 许可开源,在 SWE-Bench Verified 上得分 46.8%,比此前开源 SoTA 模型高出 6 个百分点以上。

    推荐理由:Mistral 与 All Hands AI 合作的智能体编码模型,给出 SWE-Bench Verified 成绩与本地部署门槛,便于判断开源编码模型的当前水平。

5月16日周五
  1. OpenAI News62

    OpenAI 发布 o3 与 o4-mini 系统卡补充说明:Codex

    OpenAI 为 o3 和 o4-mini 系统卡发布补充说明,介绍云端编码智能体 Codex。Codex 由 codex-1 驱动,后者是 OpenAI o3 针对软件工程优化的版本,通过强化学习在多种环境的真实编码任务上训练,以生成贴近人类风格和 PR 偏好的代码、精确遵循指令,并反复运行测试直到通过。

    推荐理由:官方系统卡补充说明披露了 Codex 背后的 codex-1 及其训练方式,可了解该编码智能体的技术来源。

5月15日周四
  1. Hugging Face Blog62

    Falcon-Edge 发布 1B 与 3B 三值量化语言模型系列

    Falcon-Edge 系列发布,基于 BitNet 架构,提供 1B 和 3B 两种规模,每种规模都有 base 与指令微调版本,权重以三值格式({-1, 0, 1})提供。

    推荐理由:Falcon-Edge 用一次预训练同时产出 bfloat16 与三值量化版本,并给出可直接微调的权重与工具包,读者可据此判断 1.58bit 模型的落地路径。

5月7日周三
4月29日周二
4月16日周三
  1. OpenAI News82

    OpenAI 发布 o3 与 o4-mini 系统卡

    OpenAI 发布 o3 和 o4-mini 的系统卡,称两款模型将前沿推理能力与完整工具能力结合。可用工具包括网页浏览、Python、图像与文件分析、图像生成、canvas、自动化、文件搜索和记忆。

    推荐理由:官方系统卡披露 o3 与 o4-mini 的推理能力与工具调用范围,可对照此前模型看能力边界。

4月14日周一
  1. OpenAI News78

    OpenAI 在 API 中发布 GPT-4.1 系列模型

    OpenAI 在 API 中发布 GPT-4.1 系列模型,官方称其在编码、指令遵循和长上下文理解上有全面提升,并同步推出首个 nano 模型。该系列即日起面向全球开发者开放。

    推荐理由:OpenAI 在 API 中上线 GPT-4.1 系列并首次推出 nano 版本,读者可了解其在编码与长上下文上的改进方向。

4月5日周六
  1. Hugging Face Blog85

    Llama 4 Maverick 与 Scout 上线 Hugging Face

    Meta 发布 Llama 4 Maverick(约 400B 总参数)与 Llama 4 Scout(约 109B 总参数),两者均为 17B 激活参数的 MoE 模型,原生支持文本与图像输入,并已在 Hugging Face Hub 上线。

    推荐理由:Hugging Face 官方给出 Llama 4 两款 MoE 模型的架构细节与部署入口,可据此判断长上下文与多模态的落地条件。

3月27日周四
3月25日周二
  1. OpenAI News75

    OpenAI 发布 GPT-4o 系统卡补充说明,介绍 4o 图像生成

    OpenAI 发布 GPT-4o 系统卡补充说明,介绍 4o 图像生成。该能力比此前的 DALL·E 3 系列模型显著更强,可生成照片级真实感输出,也能接收图像作为输入并进行变换。

    推荐理由:官方系统卡补充说明披露了 4o 图像生成相对 DALL·E 3 的能力变化,可据此了解该模型的生成与图像输入能力边界。

3月18日周二
3月17日周一
3月12日周三
  1. Hugging Face Blog80

    Google 发布 Gemma 3 开源模型:多模态、多语言、128k 上下文

    Google 发布 Gemma 3 系列开放权重模型,提供 1B、4B、12B、27B 四种规模,含预训练与指令微调版本。4B、12B、27B 支持图像与文本输入及 140 多种语言,上下文窗口从 Gemma 2 的 8k 提升至 128k,1B 版本为纯文本、32k 上下文。

    推荐理由:梳理 Gemma 3 的四种规模、多模态与 128k 上下文改动,并给出 transformers、MLX、llama.cpp 的落地路径。

3月4日周二
2月27日周四
  1. OpenAI News67

    OpenAI 发布 GPT-4.5 系统卡

    OpenAI 发布 GPT-4.5 系统卡,并以研究预览形式推出 GPT-4.5,称其是目前规模最大、知识最广的模型。

    推荐理由:OpenAI 公布 GPT-4.5 系统卡,说明这是其目前规模最大、知识最广的模型,并以研究预览形式发布。

2月21日周五
2月20日周四
2月17日周一
  1. Mistral AI60

    Mistral 发布区域语言模型 Mistral Saba

    Mistral AI 发布 Mistral Saba,这是其首个专门面向区域语言的模型,参数规模 24B,训练数据来自中东和南亚。该模型支持阿拉伯语和多种印度源语言,在泰米尔语等南印度语言上表现突出,官方称其回答比规模大 5 倍以上的模型更准确,同时速度更快、成本更低。

    推荐理由:Mistral 推出面向中东和南亚的区域语言模型,读者可了解其参数规模、语言覆盖与本地部署方式。

1月31日周五