OpenAI 为 GPT-Rosalind 推出新能力
OpenAI 宣布为 GPT-Rosalind 增加新能力,覆盖生物推理、药物化学专业知识、基因组分析和实验工作流。该模型面向生命科学研究场景,此次更新扩展了其在上述方向上的能力范围。
OpenAI 宣布为 GPT-Rosalind 增加新能力,覆盖生物推理、药物化学专业知识、基因组分析和实验工作流。该模型面向生命科学研究场景,此次更新扩展了其在上述方向上的能力范围。
DharmaOCR 团队将 Direct Preference Optimization(DPO)用于结构化 OCR 任务,以正确转录为 chosen、退化循环为 rejected 构建偏好数据,在 SFT 之后追加第二阶段训练,使所有测试模型家族的文本退化率平均下降 59.4%,最高降幅 87.6%(Nanonets-OCR2-3B 从 1.61% 降至 0.20%)。
Wasmer 借助 Codex 与 GPT-5.5 构建了面向边缘计算的 Node.js 运行时,开发速度提升 10x 至 20x,交付周期从数月缩短至数周。
OpenAI 公布其 AI 公共政策议程,涵盖安全、青少年保护、劳动力转型与全球标准四个方面,目标是确保 AI 惠及社会。
OpenAI 公布了一份针对美国前沿 AI 治理的蓝图,提议建立覆盖安全、韧性与国家安全的联邦框架。该蓝图主张以民主治理方式管理前沿 AI,具体机制与实施细节尚未在文中展开。
Reachy Mini 对话应用现可通过 MCP 调用托管在公开 Hugging Face Spaces 上的工具,用一条命令 `reachy-mini-conversation-app tool-spaces add` 即可为机器人添加天气查询、网页搜索等能力,工具在 Space 内运行,无需下载代码到本地。
Hcompany 发布 Holo3.1 系列 computer-use 模型,基于 Qwen 家族,覆盖 0.8B、4B、9B 和 35B-A3B 四种尺寸,并首次提供 FP8、Q4 GGUF 和 NVFP4 量化权重用于本地推理。
推荐理由:Holo3.1 给出跨环境、跨框架与本地量化的具体数据,可据此判断端侧 computer-use 智能体的部署成本。
Travelers 基于 OpenAI 打造了 AI 理赔助手 Claim Assistant,引导客户完成理赔申请,并提供 24/7 支持。该助手已在全国范围部署,用于在理赔高峰期扩展业务处理能力。
OpenAI 发布 ChatGPT Sites,用户可借助 Codex 创建轻量级网站或应用。目前官方仅给出这一句功能描述,未披露具体版本号、可用范围或上线时间。
OpenAI 为 Codex 推出新插件、站点和标注功能,面向分析师、营销人员、设计师、投资者等团队,帮助其用 AI 完成更多工作。原文未披露具体插件名称、版本号或可用性细节。
OpenAI 呼吁就青少年 AI 安全采取全球行动,提议设立一个国际机构,以加强保护措施、标准制定并为年轻人创造机会。
OpenAI 发布《The Next Era of Knowledge Work》报告,探讨 Codex 如何通过 AI 驱动的调研、数据分析、工作流自动化和内容创作提升生产力。
OpenAI 阐述其在 AI 政策与政治倡导上的做法,强调透明度、支持审慎监管与 AI 安全,并明确任何外部政治团体都无权代表公司发声。
JetBrains 发布 Mellum2,一个从零训练的 12B 参数 Mixture-of-Experts 模型,覆盖自然语言与代码,每个 token 仅激活 2.5B 参数,以 Apache 2.0 许可开源。官方称其面向路由、RAG、摘要、子智能体和高吞吐编码等低延迟场景,相比同规模模型推理速度提升 2 倍以上。模型已在 Hugging Face 开放下载,架构、训练与评测细节见技术报告。
推荐理由:JetBrains 开源 12B MoE 模型,激活 2.5B 参数并主打 2 倍以上推理速度,可据此判断轻量模型在 RAG 与子智能体中的定位。
Hugging Face 博客发文指出,企业级 AI 规模化落地的关键不在 LLM 本身,而在 agentic layer 中的 agent logic——即知识图谱、算法、程序分析库等软件原语,可主动引导 LLM 聚焦企业工作流、压缩上下文空间。
Import AI 459 聚焦三个议题:英国 AI Security Institute 的论文指出用 AI 监督 AI 训练的自动化对齐研究比想象中更难;另有研究提出蛋白质折叠模型的缩放定律,以及为 AI 系统灭绝风险定价的讨论。同期还提到美国 AI 经济以每年约 2,000% 的速度增长,2025 年名义 AI GDP 约 2500 亿美元。
OpenAI 在密歇根破土动工建设 1GW 数据中心项目,该项目属于 Stargate 计划的一部分。OpenAI 表示,此举旨在建设 AI 基础设施,以扩大使用范围、创造就业并支持社区。
推荐理由:OpenAI 在密歇根动工 1GW 数据中心,可了解 Stargate 算力布局的落地进展。
OpenAI 前沿模型与 Codex 已在 AWS 正式可用,企业可通过现有的 AWS 环境、控制项和采购流程接入 OpenAI。OpenAI 表示客户可借此更快从评估阶段推进到生产部署。
OpenAI 封禁了一批疑似源自中国的账号,这些账号利用 AI 生成关于美国科技政策、关税和贸易限制的评论与漫画。该行动针对名为 "Tech and Tariffs" 的影响力活动。
OpenAI 封禁了一个疑似源自中国的账号集群,该集群利用 AI 生成社交媒体内容,批评美国数据中心与 AI 基础设施。相关行动被命名为“Data Center Bandwagon”Campaign,被定性为针对美国的境外影响力活动。
Braintrust 工程师借助 Codex 与 GPT-5.5 加快实验与编码速度,将客户需求转化为代码。
波士顿儿童医院借助 OpenAI 技术改善患者护理、减轻运营负担,并帮助诊断出 40 多例罕见病病例。
OpenAI 推出 Rosalind Biodefense,向经过审核的开发者及美国政府合作伙伴扩大开放 GPT-Rosalind 的可信访问。该计划旨在利用前沿 AI 推进生物防御、公共卫生与大流行病防范工作。
Hugging Face 发布 PyTorch 性能分析系列第一篇,讲解如何用 torch.profiler 分析矩阵乘法加法运算。
OpenAI 分享第三方 AI 评估指南,覆盖前沿模型的模型能力、防护措施与有效性评估方法。该指南面向第三方评估场景,旨在为可信评估提供统一参考。
Google Research 在 I/O 2026 上发布 Gemini for Science 实验工具套件,包含基于 ERA 和 AlphaEvolve 的 Computational Discovery、基于 Co-Scientist 的 Hypothesis Generation,以及基于 NotebookLM 的 Literature Insights。
Mistral 在 AI Now Summit 2026 上发布面向工业工程的 AI 栈,与 Airbus、BMW、ASML 合作优化设计、仿真与生产,并强调对专有数据和 IP 的完全控制。
推荐理由:Mistral 一次性公布工业 AI 栈、Vibe 智能体与自建数据中心,可据此判断其企业级全栈路线。
Mistral 将 Le Chat 升级为统一 AI 智能体 Vibe,覆盖工作与编码两类任务,原有对话、设置和订阅方案一并迁移。
推荐理由:Mistral 把 Le Chat 升级为统一智能体 Vibe,读者可据此了解其工作与编码两种模式的能力边界和定价。
Endava 借助 Codex 构建智能体组织,将需求分析周期从数周缩短至数小时,并加速软件交付。该案例展示了 Codex 在企业级软件交付流程中的实际应用方式。
Mistral AI 发布 Search Toolkit 公开预览版,这是一个用于构建生产级搜索管线的可组合框架,把摄取、检索和评估统一到共享接口下,并已开源、可部署在云、本地或边缘。
推荐理由:Mistral 把摄取、检索与评估收进同一框架,读者可据此判断自建 RAG 检索链路的整合成本。
OpenAI 发布前沿治理框架(Frontier Governance Framework),阐述其 AI 安全、安保与风险管理实践如何对齐欧盟和加州正在成形的监管要求。该框架聚焦于前沿模型的治理与合规路径。
Google 为隐私分析服务提出零信任聚合方案,将新型单次消息加密聚合协议与 TEE 结合,使设备无需多轮在线交互即可提交数据。该设计保证 Google 只能获得群体的匿名聚合洞察,原始数据即使在硬件保护范围内也不会被暴露或重建,未加密数据仅在聚合匿名化后的最终阶段于设备外处理。
Mistral 将 Emmi AI 纳入麾下,推出面向工业工程的物理 AI 基础能力,可从几何与边界条件直接预测物理场,单次前向推理在单 GPU 上以秒级完成。该能力面向设计迭代提速,传统求解器保留用于验证与边缘场景,合作方包括 ASML、Airbus、Safran 和 Siemens Energy。
Mistral 收购 Emmi AI,并加倍投入面向航空航天、汽车、半导体和能源等行业的 Physics AI 基础研究。其成果包括 AB-UPT 可在单块 GPU 上处理 9M 表面和 140M 体积网格的原始几何数据,以及首个大规模多物理过程端到端深度学习代理模型 NeuralDEM。相关论文还覆盖跨音速 3D 机翼 CFD 数据集、GyroSwin 等离子体湍流模拟等方向。
Cisco 与 OpenAI 正用 Codex 重塑企业工程,帮助 Cisco 扩展 AI 原生开发、加速 AI Defense 工作并自动化缺陷修复。
OpenAI、Thrive 和 Crete 用 Codex 构建了一个可自我改进的税务智能体,用于自动完成报税、提升准确率并加速工作流。该智能体面向税务申报场景,将申报流程自动化。
Hugging Face 让 Reachy Mini 机器人实现完全本地语音对话,无需云端和 API key。
Warp 正利用 GPT-5.5 及 OpenAI 模型,在本地、云端和开源开发工作流中协调多个编码智能体。该举措是 Warp 在开源方向上的重要押注。
OpenAI 公布 2026 年选举支持方案,涵盖可靠信息、网络防御、AI 透明度、滥用防护与偏见监测五个方面。该方案旨在为选举期间提供信息保障并防范 AI 滥用风险。
Hugging Face 在 TRL 中落地 Delta Weight Sync:只把 RL 优化步之间发生变化的 bf16 权重编码成稀疏 safetensors 文件,上传到 Hugging Face Bucket,再由 vLLM 拉取应用。
推荐理由:TRL 把稀疏增量权重同步落到可 pip 安装的实现,读者可据此判断跨机房异步 RL 训练的成本结构变化。