跳到正文

#产品更新

今日 11 条
5月28日周四
  1. Mistral AI66

    Mistral AI 发布 Search Toolkit 公开预览版

    Mistral AI 发布 Search Toolkit 公开预览版,这是一个用于构建生产级搜索管线的可组合框架,把摄取、检索和评估统一到共享接口下,并已开源、可部署在云、本地或边缘。

    推荐理由:Mistral 把摄取、检索与评估收进同一框架,读者可据此判断自建 RAG 检索链路的整合成本。

5月27日周三
  1. Hugging Face Blog62

    Hugging Face 在 TRL 中实现 Delta Weight Sync,用 Hub Bucket 传输万亿参数增量

    Hugging Face 在 TRL 中落地 Delta Weight Sync:只把 RL 优化步之间发生变化的 bf16 权重编码成稀疏 safetensors 文件,上传到 Hugging Face Bucket,再由 vLLM 拉取应用。

    推荐理由:TRL 把稀疏增量权重同步落到可 pip 安装的实现,读者可据此判断跨机房异步 RL 训练的成本结构变化。

5月22日周五
5月20日周三
  1. Google Research78

    Google 发布 ERA 科研工具并开放 Computational Discovery

    Google 发布 Empirical Research Assistance(ERA),一个用 Gemini 编写和优化科学代码的研究工具,相关论文今日发表于 Nature,并开始通过 Gemini for Science 向全球科学家开放。

    推荐理由:Google 公开 ERA 在 Nature 的评测结果与八篇应用论文,读者可据此判断 AI 写科学代码的实际边界。

5月18日周一
  1. Google DeepMind62

    Google DeepMind 为 Project Genie 加入 Street View 真实地点生成能力

    Google DeepMind 在实验性原型 Project Genie 中上线 Street View 真实影像锚定能力,用户可选取美国境内地点并搭配风格与角色描述生成可交互世界。该能力由 Maps Imagery Grounding 驱动,目前仅支持美国地点,并随 Project Genie 逐步向全球 Google AI Ultra 200 美元订阅用户(18 岁以上)开放。

    推荐理由:Project Genie 接入 Street View 真实影像,读者可了解世界模型如何用真实地点锚定生成环境。

5月17日周日
  1. Google DeepMind62

    Google 将 SynthID 与 C2PA 内容验证扩展到 Search、Gemini、Chrome 和 Pixel

    Google 宣布扩展内容透明度与验证工具,把 SynthID 验证从 Gemini 应用扩展到 Search,并将在未来几周进入 Chrome;该验证功能此前已在全球被使用 5000 万次。

    推荐理由:Google 把 SynthID 与 C2PA 验证铺到 Search、Gemini、Chrome 和 Pixel,读者可了解内容溯源工具的实际覆盖范围。

5月16日周六
  1. Google DeepMind34

    剑桥大学教授用 Google DeepMind Co-Scientist 寻找新发传染病的分子开关

    剑桥大学教授 Clare Bryant 使用 Google DeepMind 的 Co-Scientist 研究流感等病原体跨物种传播引发脓毒症的分子开关,该工具从她已发表的基金申请中生成并排序假说,并优先锁定了一个她此前未关注的蛋白质。加入未发表数据后,假说逐步细化到具体氨基酸,团队正构建含氨基酸突变的细胞系进行验证。Bryant 称,原本需两到三年的实验工作,如今有望在六个月内完成。

  2. Google DeepMind22

    Google DeepMind Co-Scientist 如何助力 Calico 衰老研究

    Calico Life Sciences 的 Matt Onsum 与 Katherine Labbé 正使用 Google DeepMind 的 Co-Scientist 整合衰老生物学中零散的研究发现并生成可验证假设。在整合应激反应(ISR)研究中,该工具帮助团队提出代谢调控 ISR 的新假设,并协助优化实验设计、随结果迭代输入新信息,相关实验已产生新发现,团队计划发表结果。

4月29日周三
4月27日周一
  1. Mistral AI72

    Mistral AI 发布 Workflows 公开预览版

    Mistral AI 发布企业 AI 编排层 Workflows 公开预览版,提供持久化执行、可观测性和人工审批能力,ASML、ABANCA、CMA-CGM 等客户已用于自动化关键流程。

    推荐理由:Mistral 把企业 AI 编排层做成 Studio 内的一体化产品,读者可据此判断生产级智能体落地的工程门槛。

4月23日周四
  1. Google Research59

    Google Photos 上线 Auto frame,用生成式 AI 重设照片机位

    Google Research 宣布新方法已作为 Google Photos 的 Auto frame 功能上线,可自动调整拍摄视角。该方法先用 3D 点图估计模型重建场景与相机参数,再用生成式潜在扩散模型补全新视角下露出的空白区域,并自动检测人脸位置与广角畸变来选定理想机位。用户可在 Auto frame 候选中选择第二版重构图,一键改善含人物的照片。

4月15日周三
  1. Hugging Face Blog62

    HCompany 发布 HoloTab:可直接在浏览器中执行任务的 AI 智能体扩展

    HCompany 发布 HoloTab,一款 Chrome 扩展,可像人一样浏览网页并自动完成跨网站任务,无需任何配置或技术背景。用户只需描述需求,智能体便在浏览器内导航界面、填写字段并做出决策,底层由视觉模型、动作规划和界面理解驱动。

    推荐理由:官方给出浏览器智能体的录制复用机制与免费入口,可据此判断零门槛自动化任务的落地方式。

4月14日周二
4月13日周一
4月10日周五
4月9日周四
  1. Hugging Face Blog60

    Sentence Transformers v5.4 支持多模态嵌入与重排模型

    Sentence Transformers v5.4 更新后,可用同一套 API 编码和比较文本、图像、音频与视频,并支持多模态嵌入与重排模型。嵌入模型把不同模态映射到共享向量空间,重排模型对混合模态输入对打分,可用于视觉文档检索、跨模态搜索和多模态 RAG。

    推荐理由:官方给出 v5.4 多模态嵌入与重排的完整用法和模型清单,可据此判断跨模态检索如何接入现有 RAG 流程。

4月1日周三
  1. Hugging Face Blog62

    Hugging Face 推出 gradio.Server,让任意前端接入 Gradio 后端

    Hugging Face 发布 gradio.Server,它扩展自 FastAPI,允许用 React、Svelte 或原生 HTML/JS 自建前端,同时保留 Gradio 的排队、SSE 流式、并发控制、MCP 支持和 Spaces 上的 ZeroGPU。

    推荐理由:官方给出 gradio.Server 的完整示例与代码,读者可据此判断自建前端如何复用 Gradio 的队列与 GPU 能力。

3月31日周二
  1. Hugging Face Blog62

    Hugging Face 发布 TRL v1.0 后训练库

    Hugging Face 发布 TRL v1.0,将其从研究代码库转为带明确稳定性承诺的后训练库,目前实现超过 75 种后训练方法,月下载量 300 万次。稳定核心遵循语义化版本,覆盖 SFT、DPO、Reward modeling、RLOO 和 GRPO 等训练器;实验层不承诺兼容,新方法先在此落地。从最后一个 0.x 版本迁移改动很小,官方提供了迁移指南。

    推荐理由:官方说明 TRL v1.0 的稳定与实验分层设计,读者可据此判断后训练库的选型与迁移成本。

3月29日周日
3月25日周三
  1. Google Research60

    Google 发布 Vibe Coding XR,用 Gemini 与 XR Blocks 生成 Android XR 应用

    Google 发布 Vibe Coding XR 工作流,将 Gemini 与基于 WebXR、three.js、LiteRT.js 的 XR Blocks 框架结合,把自然语言提示词直接转成可运行的物理感知 Android XR 应用,官方称耗时在 60 秒以内。

    推荐理由:Google 把 Gemini 与 XR Blocks 组合成从自然语言到 Android XR 应用的生成流程,并给出 VCXR60 初步评测数据,可据此判断 XR 原型开发的门槛变化。

3月18日周三
  1. Mistral AI62

    Mistral AI 推出企业级模型训练系统 Forge

    Mistral AI 推出 Forge,一套让企业基于自有专有知识构建前沿级 AI 模型的系统,支持预训练、后训练和强化学习等阶段,并同时支持稠密与 MoE 架构及多模态输入。

    推荐理由:原文给出企业用自有数据训练前沿模型的分阶段训练路径与智能体落地方式,可据此判断企业自建模型的可行边界。

3月12日周四
3月11日周三
3月10日周二
3月9日周一
3月7日周六