跳到正文

#部署/工程

今日 3 条
2月28日周五
2月24日周一
2月18日周二
2月17日周一
  1. Mistral AI60

    Mistral 发布区域语言模型 Mistral Saba

    Mistral AI 发布 Mistral Saba,这是其首个专门面向区域语言的模型,参数规模 24B,训练数据来自中东和南亚。该模型支持阿拉伯语和多种印度源语言,在泰米尔语等南印度语言上表现突出,官方称其回答比规模大 5 倍以上的模型更准确,同时速度更快、成本更低。

    推荐理由:Mistral 推出面向中东和南亚的区域语言模型,读者可了解其参数规模、语言覆盖与本地部署方式。

2月14日周五
2月13日周四
2月12日周三
2月6日周四
1月30日周四
1月28日周二
  1. Hugging Face Blog62

    Hugging Face Hub 上线 Inference Providers,接入 fal、Replicate、SambaNova、Together AI

    Hugging Face 在 Hub 模型页上线 Inference Providers,首批接入 fal、Replicate、SambaNova、Together AI 四家无服务器推理服务商,并集成到 JS 和 Python 客户端 SDK。

    推荐理由:官方说明 Hub 模型页接入四家无服务器推理服务商,并给出 SDK 与路由代理的调用方式,便于判断接入成本。

1月27日周一
  1. Hugging Face Blog48

    Diffusers 中的开源视频生成模型现状

    Hugging Face 发文梳理开源视频生成模型现状,CogVideoX、Mochi-1、Hunyuan Video、Allegro、LTX Video 均已开放,而 Sora、Veo 2、Gen 3 Alpha、Kling、Pika 2.0、MiniMax 仍为闭源。文章指出开源模型受限于高算力成本、泛化能力不足和生成延迟,Diffusers 团队正从推理优化与微调两方面推进其规模化采用。

1月23日周四
1月22日周三
1月21日周二
1月16日周四
12月24日周二
12月23日周一
12月18日周三
12月17日周二
12月9日周一
12月5日周四
  1. Hugging Face Blog27

    LLM 修复自身错误的能力如何?基于 Keras 与 TPU 的 chatbot arena 实验

    Hugging Face 用 Keras、JAX 和 TPU 搭建了一个 chatbot arena,让多个 LLM 同时处理同一段日历 API 调用对话,测试它们在用户用自然语言指出错误后能否修正代码。实验在 TPU v5e 2x4 上以 bfloat16 同时加载了 5 个约 8B 参数模型和 3 个约 2B 参数模型,共 7 个 LLM,通过 Gradio Spaces 界面并行对话。

12月3日周二
11月26日周二
  1. Hugging Face Blog28

    Hugging Face 重构 Hub 上传与下载架构

    Hugging Face 的 Xet 团队正在重新设计 Hub 的上传与下载架构,计划引入内容寻址存储(CAS)作为内容分发第一站,并基于"读简单、写智能"理念构建自定义协议。新架构在字节级别分析文件,对 tensor 文件(如 Safetensors)的压缩探索有望将上传速度提升 10-25%。CAS 节点将部署在 AWS 少数区域,以覆盖北美、欧洲和亚洲的主要上传流量。

11月20日周三
11月7日周四
  1. Mistral AI40

    Mistral AI 推出 Batch API,批量推理成本降低 50%

    Mistral AI 在 La Plateforme 上线 Batch API,处理高并发请求的成本比同步 API 调用低 50%。用户上传批量文件、处理完成后下载输出文件即可,适用于情感分析、文档批量摘要与翻译、向量嵌入建索引和数据标注等场景。该 API 覆盖 La Plateforme 上全部模型,每个工作区最多 100 万个进行中的请求,并将陆续登陆其云厂商合作伙伴。

  2. Mistral AI55

    Mistral AI 发布内容审核 API

    Mistral AI 发布新的内容审核 API,即其 Le Chat 审核服务所用的同一套接口,现对外开放供用户按自身安全标准定制。该模型是一个 LLM 分类器,将文本输入分为 9 个类别,提供原始文本和对话内容两个端点,对话端点只对上下文中的最后一条消息分类。

11月5日周二
10月29日周二
10月23日周三
  1. Hugging Face Blog60

    Hugging Face 推出 HUGS 生成式 AI 服务,零配置部署开源模型

    Hugging Face 发布生成式 AI 服务 HUGS,提供零配置的优化推理微服务,基于 Text Generation Inference 和 Transformers,支持 NVIDIA、AMD GPU,AWS Inferentia 和 Google TPU 即将支持。

    推荐理由:HUGS 把开源模型的推理部署从数周压缩到分钟级,并给出兼容 OpenAI API 的落地路径,可据此判断自托管开源模型的工程成本。

10月22日周二
  1. Hugging Face Blog42

    dottxt 与 Hugging Face 发布 outlines-core 0.1.0:Rust 重写结构化生成核心

    dottxt 与 Hugging Face 联合发布 outlines-core 0.1.0,这是 outlines 结构化生成核心算法的 Rust 移植版,索引编译速度平均提升 2 倍。该库已集成进 outlines,Python 绑定 0.1.0 版本同步上线,其轻量化设计便于其他库直接引入结构化生成能力,Rust 实现还为 Python 之外的语言绑定提供了可能。

10月21日周一
10月10日周四
10月9日周三
10月8日周二