Databricks 将 GPT-5.5 引入企业智能体工作流
Databricks 将 GPT-5.5 用于企业智能体工作流,该模型在 OfficeQA Pro 基准上刷新了 SOTA。
Databricks 将 GPT-5.5 用于企业智能体工作流,该模型在 OfficeQA Pro 基准上刷新了 SOTA。
OpenAI 介绍 ChatGPT Work 在运营场景中的实用工作流,涵盖 initiative briefs、strategy updates、decision packets 和 progress reporting 四类任务。内容面向希望用 ChatGPT Work 规范运营文档与汇报流程的团队。
Sea Limited 首席产品官解释了公司为何在工程团队中全面部署 Codex,以加速亚洲的 AI 原生软件开发。该举措旨在推动智能体式软件开发在亚洲落地。
Hugging Face 发布两款基于 ModernBERT 的 Apache 2.0 多语言嵌入模型 granite-embedding-97m-multilingual-r2 和 granite-embedding-311m-multilingual-r2。
OpenAI 宣布 Codex 可在 ChatGPT 移动端使用,用户能跨设备和远程环境实时监控、引导并批准编码任务。
Hugging Face 发文解析连续批处理中的异步化,指出默认同步批处理下 CPU 与 GPU 轮流工作,用 8B 模型、batch size 32 生成 8K tokens 时总耗时 300.6 秒,其中 24.0% 时间 GPU 处于空闲等待 CPU。
OpenAI 为 ChatGPT 推出安全更新,提升其在敏感对话中的上下文感知能力,可随时间推移识别风险并更安全地回应。该更新聚焦于让模型结合对话历史判断潜在风险,而非仅依据单条消息。
OpenAI 为在 Windows 上启用 Codex 构建了安全沙箱,通过受控的文件访问和网络限制来隔离其运行环境。该沙箱旨在兼顾安全性与有效性,让 Codex 能在 Windows 平台受限地执行任务。
OpenAI 就 TanStack“Mini Shai-Hulud”供应链攻击作出回应,说明为保护系统和签名证书所采取的措施,并解释 macOS 用户为何必须在 2026 年 6 月 12 日前更新 OpenAI 应用。内容涵盖事件经过、受影响范围以及 OpenAI 如何加强对软件供应链威胁的防御。
OpenAI 介绍 ChatGPT Work 在财务场景中的实用工作流,覆盖报表、差异分析、预测、月度复盘和可直接用于决策的财务交付物。
Google DeepMind 在 Nature 发表 Co-Scientist 研究,这是一个基于 Gemini 构建的多智能体 AI 系统,可迭代生成、辩论和演化复杂科学问题的新假设。
推荐理由:原文给出多智能体系统的三阶段架构与多个实验室的落地案例,可了解 AI 参与科学假设生成的具体机制。
AutoScout24 Group 借助 Codex 和 ChatGPT 加速开发周期、提升代码质量并扩大 AI 采用范围。该案例展示了这家欧洲汽车交易平台如何将 AI 驱动的工程工作流落地到实际研发中。
OpenAI 的 Parameter Golf 活动吸引 1,000+ 名参与者、收到 2,000+ 份提交,探索严格约束下的 AI 辅助机器学习研究、编码智能体、量化与新型模型设计。
NVIDIA 工程师与研究员使用 Codex 搭配 GPT-5.5 交付生产系统,并将研究想法转化为可运行的实验。
Hugging Face 发布系列文章,分析 AWS 基础设施如何与开源软件栈配合支撑基础模型全生命周期。
2026 年第一季度 ChatGPT 采用率大幅上升,35 岁以上用户增长最快,性别使用比例也更趋均衡,显示 AI 正被更广泛的主流人群接受。
Institute for Law & AI 提出“激进可选性”监管思路,主张政府短期避免过度监管,同时提前建设信息收集、举报人保护、评估与模型权重安全等制度工具。Meta 与 KAIST 的论文提出 Neural Computer,试图把计算、内存与 I/O 统一进一个学习到的运行时状态中。
OpenAI 发文阐述企业如何将 AI 从早期实验推进到规模化复利效应,关键在于信任、治理、工作流设计与大规模质量保障。
OpenAI 开放 Campus Network 学生社团意向表,邀请全球学生社团加入,连接各地校园社群。参与者可获取 AI 工具、举办活动,共建 AI 驱动的校园社区。
OpenAI 成立新企业部署公司 DeployCo,帮助各类组织将前沿 AI 投入生产环境,并转化为可衡量的业务成果。该公司聚焦企业级部署环节,目标是让前沿 AI 真正落地并产生业务影响。
OpenAI 通过沙箱、审批机制、网络策略和智能体原生遥测来安全运行 Codex,以支持编程智能体的安全合规采用。
伯克利 AI 研究团队梳理了并行推理领域进展,指出当前多数方法(如 Self-consistency、Best-of-N、Tree of Thoughts、MCTS、ParaThinker、GroupThink、Hogwild!
OpenAI 扩展 Trusted Access for Cyber 计划,新增 GPT-5.5 和 GPT-5.5-Cyber,面向经过验证的安全防御人员,帮助他们加快漏洞研究并保护关键基础设施。
推荐理由:OpenAI 面向经审核的安全防御方开放 GPT-5.5 与 GPT-5.5-Cyber,可用于漏洞研究与关键基础设施防护。
Parloa 利用 OpenAI 模型打造可扩展的语音驱动 AI 客服智能体,让企业能够设计、模拟并部署可靠的实时交互。该方案面向大规模客服场景,强调客户愿意与之对话的服务体验。
OpenAI 在 API 中推出新的实时语音模型,可进行推理、翻译和语音转写,用于构建更自然、更智能的语音体验。
推荐理由:OpenAI 在 API 中上线新的实时语音模型,读者可据此了解语音能力在推理、翻译与转写上的扩展方向。
OpenAI 在 ChatGPT 中推出 Trusted Contact,这是一项可选安全功能,当检测到严重的自残相关风险时,会通知用户指定的可信任联系人。
Simplex 借助 ChatGPT Enterprise 和 Codex 加速软件开发,缩短了设计、构建与测试时间,并扩展了 AI 驱动的工作流。
PipelineRL 在 vLLM V0 到 V1 迁移中通过修复四项问题让 V1 与 V0 参考对齐:processed_logprobs 语义、V1 专属运行时默认值、inflight 权重更新路径,以及最终投影所用的 fp32 lm_head。
Google DeepMind 回顾 Gemini 驱动的编码智能体 AlphaEvolve 发布一年来的应用成果,称其已从试点成为 Google 基础设施的核心组件,用于优化下一代 TPU 设计并发现更高效的缓存替换策略。
推荐理由:汇总 AlphaEvolve 一年来在基因组、电网、量子物理与 TPU 设计等领域的落地数据,可看到编码智能体跨领域应用的具体边界。
OpenAI 详解 ChatGPT 的隐私保护机制:减少训练数据中的个人数据,并让用户自主控制自己的对话是否用于改进 AI 模型。
OpenAI 公布 ChatGPT Futures 2026 届名单,26 名学生创新者入选,他们用 AI 开展构建、研究与实际应用。这批学生正在重新定义学习、创造力与机会。
Uber 正用 OpenAI 驱动 AI 助手和语音功能,在全球实时交易市场中帮司机更聪明地赚钱、让乘客更快叫车。这些能力覆盖司机端与乘客端两类场景。
Singular Bank 基于 ChatGPT 和 Codex 构建了内部助手 Singularity,帮助银行家在会议准备、投资组合分析和后续跟进上每天节省 60–90 分钟。
OpenAI 的 B2B Signals 研究显示,前沿企业正通过深化 AI 采用、规模化 Codex 驱动的智能体工作流来构建持久竞争优势。该研究聚焦于前沿企业与其余企业之间不断扩大的差距。
Hugging Face 联合 Appen Inc. 与 DataoceanAI 为 Open ASR Leaderboard 引入一批私有高质量英语 ASR 数据集,覆盖多口音的朗读与对话语音,以防止 benchmaxxing 和测试集污染。
OpenAI 推出 MRC(Multipath Reliable Connection)超级计算机网络协议,通过 OCP 开放发布,用于提升大规模 AI 训练集群的韧性与性能。
OpenAI 发布欧洲青年安全蓝图(European Youth Safety Blueprint)与 EMEA Youth & Wellbeing Grants,面向青少年、家庭和教育工作者推进安全、负责任的 AI 使用。
OpenAI 扩展 ChatGPT 广告业务,推出测试版自助 Ads Manager、CPC 竞价和增强的衡量工具。官方称这些能力在设计上保护隐私,并将对话内容与广告保持分离。
OpenAI 与 PwC 达成合作,帮助企业用 AI 智能体自动化财务工作流、改进预测、强化管控并推动 CFO 职能现代化。
Jack Clark 在 Import AI 第 455 期中判断,到 2028 年底出现无需人类参与的 AI 研发(前沿模型能自主训练出自己的后继版本)的概率约为 60%,2027 年前实现的概率约 30%。