OpenAI 在 ChatGPT 中推出 Lockdown Mode 与 Elevated Risk 标签
OpenAI 在 ChatGPT 中推出 Lockdown Mode 和 Elevated Risk 标签,帮助组织防御提示词注入和 AI 驱动的数据外泄。官方仅给出这两项功能的名称与防护目标,未披露具体机制和可用范围。
推荐理由:OpenAI 在 ChatGPT 中新增面向组织的提示词注入与数据外泄防护选项,可了解其安全边界思路。
OpenAI 在 ChatGPT 中推出 Lockdown Mode 和 Elevated Risk 标签,帮助组织防御提示词注入和 AI 驱动的数据外泄。官方仅给出这两项功能的名称与防护目标,未披露具体机制和可用范围。
推荐理由:OpenAI 在 ChatGPT 中新增面向组织的提示词注入与数据外泄防护选项,可了解其安全边界思路。
OpenAI 推出开源工具包 GABRIEL,借助 GPT 把定性文本和图像转化为定量数据,帮助社会科学家大规模分析研究。该工具面向社会科学研究场景,目前已开源。
OpenAI 为 Codex 和 Sora 构建了一套实时访问系统,将速率限制、用量追踪与 credits 结合,以支撑持续访问。该系统旨在突破单一速率限制的局限,实现更稳定的规模化接入。
Hugging Face 构建了一个 agent skill,教编码智能体编写生产级 CUDA kernel,并用 Claude 和 Codex 在 diffusers 与 transformers 两个真实目标上端到端生成了可用的 kernel、PyTorch 绑定和基准测试。
推荐理由:Hugging Face 把 CUDA kernel 开发知识打包成 agent skill,并给出两个真实目标的端到端基准数据,可迁移到其他领域技能设计。
Google DeepMind 发布 Gemini 3 Deep Think 重大升级,这一专用推理模式面向科学、研究与工程难题,已在 Gemini 应用中向 Google AI Ultra 订阅用户开放,并首次通过 Gemini API 向部分研究者、工程师和企业提供早期访问。
推荐理由:官方给出 Deep Think 在 HLE、ARC-AGI-2、Codeforces 等基准上的具体成绩与开放入口,可据此判断其科研与工程定位。
OpenAI 发布 GPT-5.3-Codex-Spark,称其为首个实时编码模型,生成速度提升 15 倍,支持 128k 上下文。该模型目前面向 ChatGPT Pro 用户开放研究预览。
推荐理由:OpenAI 公布实时编码模型的速度与上下文规格,可据此判断编码工作流的响应变化。
Meta 与 Hugging Face 联合推出的开源框架 OpenEnv 用于在真实系统而非模拟环境中评测 AI 智能体,Turing 为其贡献了生产级日历管理环境 Calendar Gym。
OpenAI 技术团队成员 Ryan Lopopolo 提出 Harness engineering,探讨在智能体优先的世界中如何利用 Codex。文章聚焦于围绕 Codex 构建工程实践,而非模型本身的能力。
Google Research 发布开源原型框架 DialogLab,用于创作、模拟和测试动态的人机群组对话,相关论文在 ACM UIST 2025 展示。该框架将对话的社交设定与时间流程解耦,通过"创作-测试-验证"三阶段工作流支持多参与方、角色分组与打断规则配置。
Google Research 与 Google DeepMind 发现,主要用鸟类等陆生动物音频训练的 Perch 2.0 生物声学基础模型,在未接触任何水下音频的情况下,仍能作为嵌入模型迁移用于鲸类发声分类。
Google DeepMind 发布两篇论文,介绍由 Gemini Deep Think 驱动的数学研究智能体 Aletheia 在数学、物理和计算机科学领域解决专业研究问题。
推荐理由:DeepMind 公开了两篇论文与数学研究智能体 Aletheia 的细节,读者可据此了解 AI 参与研究级数学与理论计算机科学的实际边界。
OpenAI for Government 宣布在 GenAI.mil 上部署定制版 ChatGPT,为美国国防团队提供安全、注重安全的 AI 能力。
Hugging Face 发布 Transformers.js v4,已上线 NPM,可通过 npm i @huggingface/transformers 安装。
推荐理由:官方给出 v4 的 WebGPU 运行时重写、构建提速与包体积变化,可据此判断浏览器端推理的工程收益。
OpenAI 分享了其 AI 本地化思路:全球共享的前沿模型可在不牺牲安全性的前提下,适配各地语言、法律与文化。该方案强调在本地化过程中保持安全标准不被削弱。
Hugging Face 发布 SyGra 2.0.0 的 Studio,一个把合成数据生成变成可视化画布操作的交互环境,所有可视化配置都会生成对应的 SyGra 图配置与任务执行脚本。
OpenAI 的 GPT-5 与 Ginkgo Bioworks 的云端自动化结合组成自主实验室,通过闭环实验将无细胞蛋白质合成成本降低 40%。
OpenAI 推出 Trusted Access for Cyber,一个基于信任的框架,在扩大前沿网络安全能力访问权限的同时加强对滥用的防护。
Google 提出 Natively Adaptive Interfaces(NAI)框架,用多模态 AI 工具让 UI 从静态导航转向智能体驱动的动态模块,以缩小新功能发布与辅助层之间的"无障碍鸿沟"。原型包括面向盲人与低视力用户的 StreetReaderAI,以及基于 Gemini 模型、可实时调整描述细节的 Multimodal Agent Video Player(MAVP)。
OpenAI 发布企业平台 OpenAI Frontier,用于构建、部署和管理 AI 智能体。该平台提供共享上下文、入职引导、权限与治理能力。
推荐理由:OpenAI 把智能体构建、部署与治理收进一个企业平台,可据此判断企业级 Agent 落地路径。
OpenAI 发布 GPT-5.3-Codex 系统卡,称其为目前能力最强的智能体编码模型。该模型结合了 GPT-5.2-Codex 的前沿编码性能与 GPT-5.2 的推理和专业领域知识能力。
推荐理由:官方系统卡给出 GPT-5.3-Codex 的能力定位,读者可据此了解它在编码与推理上的组合方式。
OpenAI 发布 GPT-5.3-Codex,这是一个 Codex 原生智能体,将前沿编码能力与通用推理结合,面向长周期、真实世界的技术工作。
推荐理由:OpenAI 官方发布 Codex 原生智能体模型,可据此了解其在编码与通用推理上的定位。
Mistral AI 发布 Voxtral Transcribe 2,包含面向批量转写的 Voxtral Mini Transcribe V2 和面向实时场景的 Voxtral Realtime,支持说话人分离、上下文偏置和词级时间戳,覆盖 13 种语言。
推荐理由:官方给出两款语音转写模型的延迟、价格与开源许可,读者可据此判断实时转写的成本与部署边界。
Google Research 提出 Sequential Attention,用贪心选择机制在单次模型训练中顺序、自适应地挑选最佳组件,把子集选择直接融入训练流程,避免传统贪心算法带来的数量级训练开销。该方法在多个神经网络基准上取得 SOTA,并已用于特征选择等真实场景,兼顾效率、准确率、可解释性与大规模扩展能力。
OpenAI 介绍 Codex App Server,这是一个双向 JSON-RPC API,用于把 Codex 智能体嵌入到应用中。该接口支持流式进度、工具调用、审批和 diff 等能力。
推荐理由:OpenAI 官方说明 Codex App Server 的 JSON-RPC 接口设计,读者可了解如何把 Codex 智能体嵌入自有应用。
Hugging Face 推出 Community Evals,基准数据集仓库现在可以注册为 benchmark 并托管排行榜,模型仓库通过 .eval_results/*.yaml 存储自己的评测分数,任何用户都能以 PR 形式提交结果。
推荐理由:Hugging Face 把评测结果从黑箱榜单搬到 Hub 仓库,读者可据此理解社区化评测的运作方式。
Google 宣布与 Included Health 合作,待 IRB 批准后启动一项全国性前瞻性随机对照研究,在真实虚拟诊疗流程中评估对话 AI 的表现。
推荐理由:Google 与 Included Health 将开展全国随机对照研究,读者可了解医疗对话 AI 从模拟走向真实临床的评估路径。
H Company 发布迄今最大的 UI 定位模型 Holo2-235B-A22B Preview,在 ScreenSpot-Pro 上取得 78.5%、OSWorld G 上取得 79.0% 的 SOTA 成绩,模型已在 Hugging Face 上线。
Hugging Face 博客系列第三篇指出,开源已成为中国 AI 机构近期的主流路线,DeepSeek 是 Hugging Face 上关注度最高的组织,Qwen 位列第四。
Hugging Face 公布 PRX-1.2B 文本到图像模型的训练消融实验,在 100k 步、256×256 分辨率、全局 batch size 256 的 Flow Matching 基线上,系统对比表征对齐、训练目标、token 路由与稀疏化、数据四类技巧对收敛与效率的影响。
OpenAI 公布 Sora 信息流的设计理念,通过个性化推荐激发创作、促进连接,并以家长控制和强护栏保障体验安全。
Snowflake 与 OpenAI 达成 2 亿美元合作协议,把前沿智能引入企业数据,让 AI 智能体与洞察直接在 Snowflake 中运行。
OpenAI 发布面向 macOS 的 Codex 应用,定位为 AI 编码与软件开发的指挥中心,支持多智能体、并行工作流和长时间运行的任务。
推荐理由:OpenAI 官方给出 Codex 桌面端的产品定位与多智能体并行能力,可据此判断 AI 编码入口的形态变化。
OpenAI 封禁了一批利用 AI 支持浪漫骗局工作流的账号,这些账号将 AI 用于接触目标、翻译、与受害者互动以及投资诈骗诱饵。
OpenAI 封禁了一批与一项此前未被报道的行动相关的账号,该行动被其命名为“Trolling Stone”。这些账号利用 AI 生成关于一名据称俄罗斯邪教领袖在阿根廷被捕的评论内容。
OpenAI 封禁了一批很可能源自柬埔寨的账号,这些账号用 AI 冒充追损服务、律所和执法机构,专门针对诈骗受害者下手。该行动被命名为“False Witness”。
OpenAI 封禁了一个与中国执法相关人员关联的账号,该账号利用 AI 策划影响力活动、骚扰和线上行动。
OpenAI 封禁了与 Rybar 网络关联的账号,其中部分账号可能源自俄罗斯,这些账号利用 AI 在网站和社交平台上支持多语言影响活动。
OpenAI 封禁了一批很可能源自柬埔寨的账号,这些账号利用 AI 对印尼交友用户实施诈骗,包括翻译和互动。该行动被命名为“Date Bait”。
OpenAI 封禁了一批与代号“No Bell”行动相关的账号,该行动疑似源自俄罗斯,此前未被报道。这些账号利用 AI 面向非洲受众生成批评美国及其盟友的内容。
OpenAI 封禁了一批疑似中国来源的账号,这些账号利用 AI 研究美国人员、地点及社会工程学手法。