NVIDIA AI-Q 蓝图基于 Llama Nemotron 登顶 DeepResearch Bench 开源榜单
NVIDIA AI-Q Blueprint 在 DeepResearch Bench 的 "LLM with Search" 类别以 40.52 分登顶,成为排名最高的全开源许可方案。
NVIDIA AI-Q Blueprint 在 DeepResearch Bench 的 "LLM with Search" 类别以 40.52 分登顶,成为排名最高的全开源许可方案。
OpenAI 正在为 ChatGPT 优化多方面支持能力,包括在艰难时刻提供帮助、已上线休息提醒功能,并在专家指导下改进生活建议。这些改进旨在让 ChatGPT 更好地帮助用户。
OpenAI 在 ChatGPT 中推出学习模式(study mode),提供一种新的学习体验,帮助用户逐步解决问题。该模式通过提问、脚手架和反馈引导学生,以支持更深入的学习。
Hugging Face 发布开源免费的实验追踪 Python 库 Trackio,提供本地 Gradio 仪表盘,并可同步到 Hugging Face Spaces 分享。
Hugging Face 将 CLI 从 huggingface-cli 正式更名为 hf,命令按 auth、cache、repo 等资源分组,upload 和 download 保留在根级,旧命令仍可用但会提示弃用警告。
Outtake 利用 GPT-4.1 和 OpenAI o3 驱动 AI 智能体,将数字威胁的检测与处置速度提升至此前的 100 倍。
OpenAI 与 Penda Health 联合推出 AI 临床副驾驶,在真实使用场景中将诊断错误率降低 16%。该工具为医疗领域安全、有效地应用 AI 提供了一条新路径。
NVIDIA 宣布 NIM 推理微服务现可在 Hugging Face 上快速部署超过 10 万个 LLM。NIM 提供单个 Docker 容器,自动识别模型架构与量化格式(如 FP16、FP8、INT4),并在 NVIDIA TensorRT-LLM、vLLM 和 SGLang 之间选择推理后端,无需手动配置。
推荐理由:NIM 单个容器即可自动识别模型格式并选择 TensorRT-LLM、vLLM 或 SGLang 后端,读者可据此判断部署流程能省掉多少手工调优。
Mistral 为 Le Chat 上线一批新功能,包括预览版 Deep Research 模式、由新语音模型 Voxtral 驱动的语音模式、由推理模型 Magistral 支持的多语言推理、用于整理对话的 Projects,以及与 Black Forest Labs 合作的高级图像编辑。
推荐理由:Mistral 一次性为 Le Chat 补齐深度研究、语音、推理与图像编辑能力,可据此判断其产品线走向。
OpenAI 推出 ChatGPT agent,官方称它能思考并行动,调用工具完成研究、预订和制作幻灯片等任务,全程由用户引导。
推荐理由:OpenAI 官方给出 ChatGPT agent 的定位与任务范围,可据此判断它在研究、预订等场景中的使用方式。
OpenAI 发布 ChatGPT agent 系统卡,介绍这一智能体模型整合了研究、浏览器自动化和代码工具。系统卡说明相关能力在 Preparedness Framework 下配有安全防护措施。
推荐理由:OpenAI 官方系统卡披露 ChatGPT agent 的能力组合与 Preparedness Framework 下的安全措施,可了解其风险边界设定。
Invideo AI 借助 OpenAI 的 GPT-4.1、gpt-image-1 和文本转语音模型,将创意想法在几分钟内转化为专业视频,创作速度提升 10 倍。
Gradio 5.38.0 为 MCP Servers 带来五项改进:新增 "File Upload" MCP server 让智能体直接上传文件,支持实时进度通知,并可通过 gr.load_openapi 一行代码将 OpenAPI 规范转为 MCP server。
开发者利用 Gradio Agents & MCP Hackathon 构建了多 LLM 平台 Consilium,让多个 AI 模型通过结构化辩论就复杂问题达成共识。
Hugging Face 发布 ScreenEnv,一个可在 Docker 容器中创建隔离 Ubuntu 桌面环境的 Python 库,用于测试和部署 GUI 智能体(Computer Use 智能体)。
推荐理由:ScreenEnv 把桌面智能体的运行环境封装进 Docker,并同时提供 MCP 与直接 API 两种接入方式,读者可据此判断现有智能体架构能否低成本迁移。
Hugging Face 与 Pollen Robotics 发布开源机器人 Reachy Mini,Lite 版 399 美元、带板载计算与电池的无线版 499 美元,均需另付税费和运费,预计约 90 天发货。
推荐理由:官方给出开源桌面机器人的两档配置、价格与 Python SDK,可据此判断入门机器人 AI 实验的成本与上手门槛。
Genspark 借助 GPT-4.1 和 OpenAI Realtime API 构建无代码个人智能体,45 天内做到 3600 万美元 ARR。该产品主打无代码方式,让用户无需编程即可搭建个人 AI 智能体。
Retell AI 基于 GPT-4o 和 GPT-4.1 打造 AI 语音自动化,正改造呼叫中心。其无代码平台让企业无需脚本即可上线自然的实时语音智能体,降低通话成本、提升 CSAT 并自动处理客户对话。
AI GTM 平台 Unify 采用 OpenAI 的 o3、GPT-4.1 和 CUA,自动化潜客挖掘、调研与外联流程。借助超个性化消息和全天候工作流,Unify 帮助团队规模化生成销售管道,同时聚焦高价值客户互动。
SGLang 新增 Hugging Face transformers 后端支持,可自动回退运行其未原生支持的 transformers 模型,也可通过 impl="transformers" 显式指定。
Groq 现已作为 Inference Provider 接入 Hugging Face Hub,支持 Llama 4、QWQ-32B 等开源模型的 serverless 推理,并集成 JS 和 Python 客户端 SDK。
Featherless AI 现已作为 Inference Provider 接入 Hugging Face Hub,支持 DeepSeek、Meta、Google、Qwen 等最新开源文本与对话模型,并集成到 JS 和 Python 客户端 SDK。
Hugging Face 在 GTC Paris 宣布与 NVIDIA 合作推出 Training Cluster as a Service,让全球研究机构更容易获取大型 GPU 集群,按训练时长付费。
推荐理由:Hugging Face 与 NVIDIA 把 GPU 集群申请、调度和训练工具串成一条流程,读者可据此判断中小研究团队获取算力的门槛变化。
Mistral 发布企业级 AI 编码助手 Mistral Code,整合 Codestral、Codestral Embed、Devstral 和 Mistral Medium 四个模型,提供 IDE 插件、本地部署选项和企业管理工具,基于开源项目 Continue 构建。
推荐理由:Mistral 把模型、IDE 插件与企业管控打包成一套可私有部署的编码方案,读者可据此判断企业级 AI 编码的落地路径。
Wix 的 AI Website Builder 由 OpenAI 提供支持,用户只需在对话中描述想法,即可在几分钟内创建完整网站。
Mistral 发布 Agents API,将自家语言模型与代码执行、网页搜索、图像生成、MCP 工具等内置连接器结合,并提供跨对话的持久记忆和智能体编排能力。
推荐理由:官方给出 Agents API 的连接器、记忆与多智能体编排能力,读者可据此判断企业级智能体平台的搭建方式。
Dell 在 Dell Tech World 发布新版 Dell Enterprise Hub,提供 Meta Llama 4 Maverick、DeepSeek R1、Google Gemma 3 等模型的预测试容器,可在 NVIDIA H200、AMD MI300X 等 Dell PowerEdge 服务器上通过 Docker 和 Kubernetes 部署。
CodeRabbit 借助 OpenAI 的 o3、o4-mini 和 GPT-4.1 模型改造代码审查流程,提升审查准确率并加快 PR 合并速度。该方案帮助开发者更快交付代码,同时减少 bug、提高投资回报率。
OpenAI 发布 Codex。原文正文抓取失败,仅标题可用,暂无更多细节。
Hugging Face 宣布将 Transformers 打造为跨框架的模型定义中枢,模型架构只要被 Transformers 支持,就能在生态其他工具中获得支持。目前 Transformers 已支持 300+ 模型架构,平均每周新增约 3 个,并与 vLLM、SGLang、TGI 等推理引擎及 llama.cpp、MLX 打通互操作。官方还计划简化建模代码、弃用冗余组件,降低社区贡献门槛。
推荐理由:Hugging Face 官方说明 Transformers 将作为跨框架的模型定义中枢,读者可据此理解模型一次贡献、多引擎复用的生态走向。
Hugging Face 与 Kaggle 推出集成,Kaggle 用户可直接在平台上发现并使用 Hugging Face 模型,如在 Qwen/Qwen3-1.7B 等模型页点击“Use this model”选择 Kaggle 即可生成含加载代码的 Notebook。
Hugging Face 在 Inference Endpoints 上线新版 OpenAI Whisper 部署方案,基于 vLLM 实现,性能较此前版本最高提升 8 倍,转录质量无损。
Mistral 发布 Le Chat Enterprise,一款由全新 Mistral Medium 3 模型驱动的企业级 AI 助手,提供企业搜索、Agent 构建器、自定义数据与工具连接器、文档库、自定义模型和混合部署等功能,全部功能将在未来两周内逐步上线。
推荐理由:Mistral 把企业搜索、Agent 构建与混合部署打包进同一平台,可据此判断企业级 AI 助手的集成路径。
圣安东尼奥马刺队正使用定制 GPT 提升球迷互动、简化运营,并推动各团队创新。
Lowe's 与 OpenAI 合作构建了 Mylow 和 Mylow Companion 两款 AI 工具,为顾客和门店员工提供专家级家装项目协助。这两款工具旨在让复杂的家居改造项目更易规划、推进和完成。
ChatGPT for Business 迎来 4 月更新,新增 o3 模型、图像生成、增强记忆和内部知识功能。官方同步放出了这些新能力的实操演示视频。
Cohere 正式接入 Hugging Face Inference Providers,成为首个在 HF Hub 上直接分享并托管自家模型的模型厂商。
Hugging Face 与 Cloudflare 达成合作,FastRTC 开发者用 Hugging Face token 即可接入 Cloudflare 的 WebRTC 基础设施。
Hugging Face 通过 PR #3091 将 Intel Gaudi 硬件支持原生集成进 Text Generation Inference(TGI),取代此前独立维护的 tgi-gaudi 分支,覆盖 Gaudi1、Gaudi2、Gaudi3 全线硬件。
OpenAI 提出从基于意图的机器人转向主动式 AI 智能体。原文未披露具体模型版本、参数规模或可用性信息。