OpenAI 计划在美国为 ChatGPT 免费与 Go 档测试广告
OpenAI 计划在美国为 ChatGPT 的免费档和 Go 档测试广告,以扩大全球范围内可负担的 AI 使用渠道。官方表示测试过程中会保护隐私、信任与回答质量。
推荐理由:OpenAI 官方说明 ChatGPT 免费与 Go 档将试水广告,可据此观察其商业化与可及性之间的取舍。
OpenAI 计划在美国为 ChatGPT 的免费档和 Go 档测试广告,以扩大全球范围内可负担的 AI 使用渠道。官方表示测试过程中会保护隐私、信任与回答质量。
推荐理由:OpenAI 官方说明 ChatGPT 免费与 Go 档将试水广告,可据此观察其商业化与可及性之间的取舍。
Google 研究团队提出一种基于时序卷积网络(TCN)的多头深度学习模型,仅凭单只 Pixel Watch 的 IMU 信号和用户身高,即可直接估算步速、步长、双支撑时间等多项步态指标。在 246 名参与者、约 7 万段步行数据的验证中,手表估算与手机结果无显著差异(p>0.05),多数指标 Pearson r>0.80、ICC>0.80。
OpenAI 投资 Merge Labs,以支持连接生物智能与人工智能的新型脑机接口,目标是最大化人类的能力、能动性与体验。
OpenAI 发起一项新的 RFP,旨在通过加速美国本土制造、创造就业岗位并扩展 AI 基础设施,来强化美国 AI 供应链。
OpenAI 发起、开源 AI 社区共建、Hugging Face 生态支持的开放推理标准 Open Responses 发布,它基于 Responses API,面向智能体工作流设计。
推荐理由:OpenAI 发起、开源社区共建的推理标准,读者可据此了解 Responses API 开放后的接口变化与迁移路径。
OpenAI 宣布与 Cerebras 合作,新增 750MW 高速 AI 算力,用于降低推理延迟并让 ChatGPT 在实时 AI 负载下响应更快。
Google Research 利用 Virginia 和 California 的公开碰撞数据与 Android Auto 匿名聚合的急刹车事件(HBE,减速度超过 -3m/s²)数据,通过负二项回归模型确认 HBE 频率与路段碰撞率呈显著正相关。
Google 发布 MedGemma 1.5 4B,新增对 CT、MRI 和全切片病理等高维医学影像的支持,并同步推出医疗听写语音识别模型 MedASR。
推荐理由:官方给出 MedGemma 1.5 与 MedASR 的基准对比和开放下载入口,可据此判断医疗多模态模型的可用边界。
Google DeepMind 更新 Veo 3.1 的 Ingredients to Video 能力,让基于参考图生成的视频在简单提示词下也有更丰富的对白与叙事,并提升角色、背景和物体的一致性。
推荐理由:官方说明了 Ingredients to Video 在角色一致性与竖屏输出上的具体变化,可据此判断移动端短视频工作流是否值得切换。
Zenken 全公司部署 ChatGPT Enterprise 后,销售业绩提升、准备时间缩短、提案成功率提高。AI 支持的工作流帮助这支精简团队实现更个性化、更有效的客户互动。
Google Research 在 Science Advances 发表论文,介绍混合模型 NeuralGCM 直接使用 NASA 2001 至 2018 年卫星降水观测训练其机器学习部分,而非依赖再分析数据。
伯克利 AI Research 提出一套基于互信息的成像系统评估与优化框架,可直接从含噪测量中估计信息量,预测系统性能。在彩色摄影、射电天文、无镜头成像和显微成像四个领域验证中,该指标正确排序了不同硬件设计,优化后性能匹配 SOTA 端到端方法,且内存与算力需求更低、无需任务专用解码器设计。
OpenAI 与软银集团合作,联合 SB Energy 开发多吉瓦级 AI 数据中心园区,其中包括一座位于德克萨斯州、容量 1.2 GW 的设施,用于支持 Stargate 计划。
Datadog 采用 OpenAI 的 Codex 进行系统级代码审查。该做法将 Codex 用于跨系统的代码审查场景,而非仅限单文件或局部改动。
OpenAI 推出 OpenAI for Healthcare,提供安全的企业级 AI 并支持 HIPAA 合规。该方案旨在减轻行政负担并支持临床工作流。
Netomi 借助 GPT-4.1 和 GPT-5.2 扩展企业级 AI 智能体,通过并发、治理与多步推理支撑可靠的生产工作流。该方案面向企业规模化部署场景,强调智能体系统在生产环境中的稳定性。
Tolan 基于 GPT-5.1 构建了一款语音优先的 AI 伴侣,结合低延迟响应、实时上下文重建和记忆驱动的人格设定,实现自然对话。
OpenAI 推出 ChatGPT Health,这是一个可安全连接个人健康数据与应用的独立体验。官方称其具备隐私保护措施,并采用由医生参与设计的方案。
推荐理由:OpenAI 官方给出 ChatGPT Health 的定位与隐私设计,读者可据此判断健康数据接入的边界。
NVIDIA 发布开源推理视觉语言模型 Cosmos Reason 2,在 Physical AI Bench 和 Physical Reasoning 榜单上成为排名第一的开源视觉理解模型。
推荐理由:Cosmos Reason 2 把上下文从 16K 提到 256K 并新增轨迹与 OCR 能力,可据此判断物理 AI 视觉推理的可用边界。
TII 发布 Falcon-H1-Arabic 阿拉伯语模型家族,包含 3B、7B、34B 三个参数版本,采用在每个 block 内并行运行 Mamba 状态空间模型与 Transformer 注意力的 Falcon-H1 混合架构。
推荐理由:原文给出三个参数规模的架构、上下文窗口与基准对比,可据此判断阿拉伯语模型的部署选型。
NVIDIA 在 CES 2026 发布博客,给出用 DGX Spark 加 Reachy Mini 复现黄仁勋主题演讲中桌面智能体的分步教程,源码已开源。
推荐理由:完整复现路径覆盖模型选型、路由与工具调用,可据此搭一套本地私有桌面智能体。
OpenAI Grove 第二期现已开放申请,这是一个为期 5 周的创始人项目,面向从仅有想法到已有产品的任何阶段参与者。入选者可获得 5 万美元 API 额度、AI 工具早期访问权限以及 OpenAI 团队的实操指导。
Google 回顾 2025 年在 8 个领域的研究突破,模型方面 3 月发布 Gemini 2.5、11 月推出 Gemini 3、12 月推出 Gemini 3 Flash,其中 Gemini 3 Pro 登顶 LMArena 并在 MathArena Apex 取得 23.4% 的 SOTA。
ServiceNow 发布 AprielGuard,一个 8B 参数的安全与安全防护模型,可检测 16 类安全风险以及提示词注入、越狱、思维链污染、上下文劫持、记忆投毒和多智能体攻击序列等对抗攻击。
OpenAI 宣布全球客户数已超过 100 万。PayPal、Virgin Atlantic、BBVA、Cisco、Moderna 和 Canva 等公司正在用 OpenAI 改变工作方式。
Google Research 回顾 2025 年成果:Gemini 3 成为其最强、最注重事实准确性的 LLM,在 SimpleQA Verified 和与 Google DeepMind、Kaggle 联合发布的新 FACTS 基准上达到 SOTA。
OpenAI 推出面向思维链可监控性的新框架与评测套件,覆盖 24 种环境下的 13 项评估。结果显示,监控模型内部推理远比仅监控输出更有效,为 AI 系统能力提升后的可扩展控制提供了可行路径。
OpenAI 更新 Model Spec,新增 Under-18 Principles,规定 ChatGPT 应基于发展科学为青少年提供安全、适龄的引导。此次更新强化了防护栏,并明确了模型在更高风险情境下的预期行为,是其改善 ChatGPT 青少年安全整体工作的一部分。
OpenAI 与美国能源部签署谅解备忘录,深化在 AI 与先进计算领域的合作,以支持科学发现。该协议基于双方与美国国家实验室的现有合作,旨在建立将 AI 应用于能源部生态系统中高影响力研究的框架。
OpenAI 发布面向青少年与家长的 AI 素养资源,帮助其更审慎、安全且有信心地使用 ChatGPT。指南包含经专家审核的建议,涵盖负责任使用、批判性思维、健康边界,以及如何支持青少年应对情绪或敏感话题。
Hugging Face 在 Transformers v5 中重构了 tokenizer 设计,将 tokenizer 架构与训练好的词表分离,类似 PyTorch 将网络架构与学习权重分离。v5 提供更清晰的内部结构、干净的类层级和单一快速后端,让用户能检查、定制或从零训练模型专属 tokenizer,而非将其视为黑盒。
OpenAI 发布 GPT-5.2-Codex,称其为该公司最先进的编码模型。该模型主打长程推理、大规模代码转换以及增强的网络安全能力。
推荐理由:OpenAI 官方发布新一代编码模型,读者可据此了解其在长程推理与大规模代码改造上的定位。
OpenAI 发布 GPT-5.2 系统卡增补文件,涉及 GPT-5.2-Codex。该页面为 OpenAI News 官方条目,正文内容未能抓取,仅标题可用。
Mistral AI 发布 Mistral OCR 3,在表单、扫描文档、复杂表格和手写内容上相对 Mistral OCR 2 的整体胜率为 74%,并称其准确率超过企业文档处理方案与 AI 原生 OCR 方案。
推荐理由:官方给出与上一代在表单、手写和表格上的胜率对比,以及每千页定价,可据此判断文档解析成本与适用场景。
NVIDIA 发布 Nemotron 3 Nano 30B A3B,并公开其完整评测配方,基于开源库 NeMo Evaluator 构建,任何人可重跑评测流程并独立核验结果。
Google DeepMind 发布 Gemini 3 Flash,将 Gemini 3 的推理能力与 Flash 级延迟和成本结合,定价为每 100 万输入 token 0.50 美元、每 100 万输出 token 3 美元。
推荐理由:官方给出 Gemini 3 Flash 的基准分数、定价与上线渠道,可据此判断它在速度与成本上的取舍。
OpenAI 联合 American Journalism Project 和 The Lenfest Institute 推出 OpenAI Academy for News Organizations,这是一个帮助新闻编辑室有效使用 AI 的学习中心。该 Academy 提供培训、实用案例和负责任使用指南,支持记者、编辑和出版方在报道与运营中采用 AI。
OpenAI 宣布开发者可以向 ChatGPT 提交应用,经审核通过后会在产品内的新应用目录中展示。官方同时更新了工具、指南和 Apps SDK,用于构建把真实操作带入 ChatGPT 的对话原生体验。
推荐理由:OpenAI 开放 ChatGPT 应用提交入口并给出 Apps SDK 与审核规范,开发者可据此判断接入路径。
OpenAI 发布企业 AI 应用现状报告,基于数据展示各组织如何从试验阶段走向实际生产力提升与新能力构建。
Google DeepMind 发布 Gemma Scope 2,一套面向 Gemma 3 全系列(270M 至 27B 参数)的开源可解释性工具,结合稀疏自编码器(SAE)与 transcoder 查看模型内部计算。
推荐理由:Gemma Scope 2 覆盖 Gemma 3 全系列并提供 SAE 与 transcoder,读者可据此了解模型可解释性工具的开源进展。