《华盛顿邮报》与 OpenAI 合作,将新闻内容接入 ChatGPT 搜索
《华盛顿邮报》与 OpenAI 达成合作,将其新闻内容整合进 ChatGPT,为用户提供摘要、引语和原文报道的直接链接。
《华盛顿邮报》与 OpenAI 达成合作,将其新闻内容整合进 ChatGPT,为用户提供摘要、引语和原文报道的直接链接。
TNG 在 24 张 H100 GPU 集群上自托管多个大语言模型,支撑 50 个应用、每小时超 5,000 次推理、每天生成超一千万 token,并分析了并发请求下 prefill 与 decode 两阶段的性能差异。
OpenAI 发布 o3 和 o4-mini 的系统卡,称两款模型将前沿推理能力与完整工具能力结合。可用工具包括网页浏览、Python、图像与文件分析、图像生成、canvas、自动化、文件搜索和记忆。
推荐理由:官方系统卡披露 o3 与 o4-mini 的推理能力与工具调用范围,可对照此前模型看能力边界。
Gradio 不只是构建 UI 的 Python 库,而是通过 UI 和 API 与机器学习模型交互的框架。所有 Gradio 应用自带 API,提供 Python(gradio_client)和 JavaScript(@gradio/client)官方 SDK 及 cURL 访问,并自动生成 REST 端点和 API 文档。
普林斯顿团队发布 HELMET 长上下文语言模型评测基准,已评估 59 个近期 LCLM,并将在 ICLR 2025 展示。该基准针对现有评测过度依赖 NIAH 等合成任务、与实际下游表现相关性差的问题,从多样性、可控性和可靠性三方面改进。
Cohere 正式接入 Hugging Face Inference Providers,成为首个在 HF Hub 上直接分享并托管自家模型的模型厂商。
OpenAI 任命四位新顾问,为其慈善事业提供指导。
OpenAI 发布更新版 Preparedness Framework,用于衡量和防范前沿 AI 能力带来的严重危害。该框架聚焦前沿 AI 能力可能造成的严重风险,并给出相应的测量与防护方法。
OpenAI 在 API 中发布 GPT-4.1 系列模型,官方称其在编码、指令遵循和长上下文理解上有全面提升,并同步推出首个 nano 模型。该系列即日起面向全球开发者开放。
推荐理由:OpenAI 在 API 中上线 GPT-4.1 系列并首次推出 nano 版本,读者可了解其在编码与长上下文上的改进方向。
Protect AI 与 Hugging Face 合作半年,截至 2025 年 4 月 1 日已扫描 Hugging Face Hub 上 141 万个仓库中的 447 万个模型版本,在 5.17 万个模型中识别出 35.2 万个不安全或可疑问题。
Hugging Face 宣布收购已成立 9 年的开源机器人公司 Pollen Robotics,这是其第五次收购,此前曾收购 Gradio 和 XetHub。
推荐理由:Hugging Face 收购 Pollen Robotics 并开卖 Reachy 2,可看到开源机器人从代码库走向硬件销售的具体路径。
Language Technologies Lab 发布 Visual Salamandra,将 Salamandra Instructed 7B 大语言模型扩展至图像和视频多模态任务,集成 Google SigLIP-So400m 编码器与 2 层 MLP 投影器,采用四阶段训练,使用 610 万条指令微调样本(含 84.2 万条纯文本)。
OpenAI 推出 BrowseComp,一个用于评估浏览智能体(browsing agents)的基准测试。该基准旨在衡量智能体在网页浏览任务中的能力表现。
Mistral 提出用 LLM as a Judge 评估 RAG 系统,由 judge LLM 按数值、二元或定性量表为 generator LLM 的回答打分,再对评测数据集求加权平均。
Hugging Face 与 Cloudflare 达成合作,FastRTC 开发者用 Hugging Face token 即可接入 Cloudflare 的 WebRTC 基础设施。
Hugging Face 与 MBZUAI 合作推出 Arabic-Leaderboards Space,统一阿拉伯语 AI 评测入口,目前上线 AraGen-03-25 和 Arabic Instruction Following 两个榜单。
Canva 联合创始人兼首席产品官 Cameron Adams 就 Canva 如何借助 AI 赋能创意展开对话。
Meta 发布 Llama 4 Maverick(约 400B 总参数)与 Llama 4 Scout(约 109B 总参数),两者均为 17B 激活参数的 MoE 模型,原生支持文本与图像输入,并已在 Hugging Face Hub 上线。
推荐理由:Hugging Face 官方给出 Llama 4 两款 MoE 模型的架构细节与部署入口,可据此判断长上下文与多模态的落地条件。
Hugging Face 的 Gradio 月活开发者已超过 100 万,Automatic1111、Oobabooga 的 Text Generation WebUI、Dall-E Mini 和 LLaMA-Factory 等热门开源项目均基于它构建。
Hugging Face 将已有 3 年历史的 NLP Course 更名为 LLM Course,并新增微调 LLM、构建 Deepseek R1 等推理模型的章节。
TNG Technology Consulting 分享了自托管 LLM 服务中请求排队问题的解决方案:在 vLLM 等推理引擎前加一层 LLM-Server,为每个用户和模型维护独立队列并采用轮询调度,避免"重度用户"阻塞他人。
OpenAI 宣布成立一个新委员会,为其打造“全球装备最完善的非营利组织”提供洞察。OpenAI 本身已是非营利组织,并已在用 AI 帮助人们解决难题,其目标是将潜在的历史性财务资源与可规模化放大人类创造力的技术相结合。
OpenAI 推出 PaperBench,用于评估 AI 智能体复现前沿 AI 研究的能力。该基准衡量智能体能否从零复现 state-of-the-art AI 研究,具体任务、评分方式与结果尚未在原文中披露。
OpenAI 就英国版权咨询提交回应,提出有利于创新的政策建议,目标是帮助英国成为欧洲的 AI 之都。
Hugging Face 将密钥管理从 AWS 单云方案迁移至 Infisical,以支撑其 Hub 上超 400 万构建者的多云端(Azure、GCP)环境。团队通过 Infisical Kubernetes Operator 自动同步密钥更新,并借助 Okta 集成实现细粒度 RBAC,取代了不安全的本地 .env 文件。工程师仍偏好手动重新部署,以应对每分钟超 1000 万请求的高流量场景。
Hugging Face 通过 PR #3091 将 Intel Gaudi 硬件支持原生集成进 Text Generation Inference(TGI),取代此前独立维护的 tgi-gaudi 分支,覆盖 Gaudi1、Gaudi2、Gaudi3 全线硬件。
DeepSeek 本周在 Hugging Face Hub 上线 DeepSeek-V3 0324,架构与初代 DeepSeek-V3 相同,但改用 MIT 许可,重点提升指令遵循、代码与数学能力。
推荐理由:梳理 DeepSeek-V3 0324 的基准提升与 MIT 许可变化,并给出本地部署与安全使用的具体路径。
Sentence Transformers 库可用于微调 reranker(Cross Encoder)模型,使其在自有数据上超越所有现有方案,也能从零训练出强力的新 reranker。
OpenAI 宣布领导层更新,称公司规模已大幅扩张,但仍聚焦于加速人类进步的前沿 AI 研究,同时产品已服务数亿用户。
Gradio 为 gr.Dataframe 组件发布大规模更新,6 周内关闭超 70 个 dataframe 相关问题。新增多单元格选择、行号与列固定(pinned_columns)、复制与全屏按钮、搜索与过滤(show_search)、静态列(static_columns)等功能,并升级键盘导航与样式定制。
OpenAI 与 MIT Media Lab 开展研究合作,探索 ChatGPT 情感使用与情绪健康的早期研究方法。该合作聚焦于研究 AI 聊天机器人在情感层面的使用方式及其对用户心理健康的影响。
Hugging Face 为 Inference Endpoints 上线新版分析面板,指标数据改为实时更新,并重写了后端以加快高流量端点的数据加载。新面板支持自定义时间范围与自动刷新,还新增副本生命周期视图,可追踪每个副本从初始化到终止的每次状态转换。官方表示仍在持续迭代并欢迎用户反馈。
Booking.com 将自身数据系统与 OpenAI 的 LLM 集成,用于提供更智能的搜索、更快的客服支持和意图驱动的旅行体验。
Hugging Face 博客介绍了如何在本地通过 LM Studio 和 VS Code 的 Continue 扩展运行 OlympicCoder 7B 编程模型,推荐使用 4bit GGUF 量化版本。该模型在 LiveCodeBench 评测中表现优于 Claude 3.7 Sonnet 和 GPT-4o,基于 CodeForces-CoTs 数据集优化,适合处理竞赛类编程难题。
Hugging Face 于 3 月 14 日向白宫 OSTP 的 AI 行动计划 RFI 提交回应,主张开放 AI 系统与开放科学是提升性能、采用率与安全性的基础。
EliseAI 正借助 AI 提升住房与医疗领域的效率。OpenAI 发布了对 EliseAI CEO 兼联合创始人 Minna Song 的访谈,讨论相关实践。
OpenAI 公布 ChatGPT for Business 2025 年 3 月新功能,ChatGPT 正变得更具交互性、更贴合团队工作方式,并具备智能体能力。官方表示此次分享涵盖最新发布内容,但未披露具体功能名称、版本号或可用性细节。
Hugging Face 的 Xet 团队将首批 Model 和 Dataset 仓库从 LFS 迁移到 Xet 存储,迁移了 4.5 TB 数据,约 6% 的 Hub 下载流量转到 Xet 基础设施。
推荐理由:Hugging Face 官方复盘 Xet 存储首次迁移,给出块级去重带来的上传下载变化与迁移中的工程取舍。
NVIDIA 在 GTC 2025 上发布三项面向物理 AI 的开源成果:世界基础模型 Cosmos Transfer、Physical AI Dataset 以及人形机器人基础模型 NVIDIA Isaac GR00T N1。
推荐理由:NVIDIA 一次性开源世界模型、数据集与人形机器人基础模型,读者可据此判断物理 AI 开发可用的工具链起点。
Mistral AI 发布 Mistral Small 3.1,在 Mistral Small 3 基础上提升文本性能与多模态理解,上下文窗口扩展至 128k tokens,推理速度达 150 tokens per second,采用 Apache 2.0 许可。
推荐理由:官方给出 Mistral Small 3.1 的基准对比、128k 上下文与端侧运行门槛,便于判断小模型选型。