OpenAI 推出 OpenAI for Ireland,携手爱尔兰政府扶持初创企业
OpenAI 推出 OpenAI for Ireland,与爱尔兰政府、Dogpatch Labs 和 Patch 合作,帮助中小企业、创始人和年轻开发者用 AI 创新、提升生产力并打造下一代爱尔兰科技初创公司。
OpenAI 推出 OpenAI for Ireland,与爱尔兰政府、Dogpatch Labs 和 Patch 合作,帮助中小企业、创始人和年轻开发者用 AI 创新、提升生产力并打造下一代爱尔兰科技初创公司。
AMD、Hugging Face 与 Data Monsters 联合举办 AMD Open Robotics Hackathon,首场线下赛于 2025 年 12 月 5-7 日在东京举行,第二场于 12 月 12-14 日在巴黎举行。
Google DeepMind 联合 Google Research 发布 Natural Forests of the World 2020,这是首个全球一致、10 米分辨率、可区分天然林与其他树木覆盖的地图数据集,独立数据集验证准确率达 92.2%。
Google DeepMind 发布 SIMA 2,将 Gemini 模型嵌入智能体核心,使其从指令跟随者升级为能思考目标、与用户对话并随时间自我改进的交互式游戏伙伴。
推荐理由:SIMA 2 把 Gemini 的推理能力接入 3D 游戏智能体,读者可了解从指令跟随到自主推理与自我改进的路径。
OpenAI 正在探索机制可解释性,以理解神经网络如何进行推理。其提出的稀疏模型方法有望让 AI 系统更透明,并支持更安全、更可靠的行为。
Google Quantum AI 联合斯坦福、MIT、Caltech 在 Nature 论文中提出量子算法 Decoded Quantum Interferometry(DQI),利用量子干涉将优化问题转化为可高效求解的解码问题。
Philips 正借助 ChatGPT Enterprise 在全公司推广 AI 素养,计划培训 7 万名员工负责任地使用 AI,以改善全球医疗健康成果。
OpenAI 在 API 中上线 GPT-5.1,带来更快的自适应推理、扩展的提示词缓存和改进的编码表现。该版本还新增 apply_patch 和 shell 工具。
推荐理由:OpenAI 官方给出 GPT-5.1 在 API 中的能力变化与新增工具,读者可据此判断现有调用链是否需要调整。
Hugging Face 宣布与 Google Cloud 建立更深层合作,让企业用开放模型构建自有 AI。
ChatGPT 上线群聊功能,支持多人加 ChatGPT 在同一对话中协作。用户可邀请他人加入同一会话,与 ChatGPT 一起完成讨论与协作。
Google 发布 JAX-Privacy 1.0,这是构建在 JAX 之上、用于训练和审计差分隐私(DP)模型的工具库,重新设计以提升模块化,支持 DP-SGD、DP-FTRL 及 DP matrix factorization 等算法。
Neuro 使用 ChatGPT Business 在全国范围扩张,团队规模不到 70 人。该方案帮助其节省时间、降低成本,并将销售与运营环节更快的执行转化为增长。
OpenAI 正对抗《纽约时报》要求其交出 2000 万条私密 ChatGPT 对话的诉求,并加速推出新的安全与隐私保护措施以保护用户数据。
OpenAI 升级 GPT-5 系列,推出 GPT-5.1,模型更温和、能力更强,并新增自定义 ChatGPT 语气和风格的方式。GPT-5.1 从今天起向付费用户逐步推送。
推荐理由:OpenAI 官方公布 GPT-5 系列的升级方向与付费用户推送节奏,可据此了解 ChatGPT 的对话风格变化。
OpenAI 发布 GPT-5 系统卡补充说明,给出 GPT-5.1 Instant 与 GPT-5.1 Thinking 的更新安全指标,并新增心理健康与情感依赖方面的评估。
推荐理由:官方补充卡给出 GPT-5.1 两个版本的安全指标更新,并新增心理健康与情感依赖评估。
Google DeepMind 在 Nature 发表新论文,提出三步对齐方法,将视觉模型的内部表征重组得更接近人类认知。研究基于 THINGS 数据集训练 SigLIP-SO400M 适配器生成百万级图像的 AligNet 数据集,再微调其他模型,使其在"找不同"任务上更符合人类判断,并提升鲁棒性与泛化能力。
北爱尔兰 C2k 与 Google for Education 合作的六个月试点中,100 名教师将 Gemini 和 Google Workspace 工具引入课堂,每位参与教师平均每周节省 10 小时,并沉淀出 600 多个 Gemini 使用案例。
OpenAI 向退役或离职 12 个月内的美国军人和退伍军人免费提供一年 ChatGPT Plus,用于简历、面试、教育和未来规划。该福利面向过渡到平民生活的服役人员。
Google Research 在 NeurIPS 2025 论文《Nested Learning: The Illusion of Deep Learning Architectures》中提出 Nested Learning,把模型架构与优化算法视为同一套相互嵌套、同时优化的多层级学习问题,以缓解持续学习中的灾难性遗忘。
OpenAI 发文解析提示词注入这一 AI 系统面临的前沿安全挑战,说明此类攻击的运作方式,并介绍其在研究、模型训练和用户防护措施上的推进方向。
Google 推出数据科学智能体 DS-STAR,通过数据文件分析、LLM 评判验证与顺序规划迭代三项机制,在 DABStep、KramaBench、DA-Code 三个基准上全面超越 AutoGen 和 DA-Agent,准确率分别从 41.0% 提升至 45.2%、39.8% 提升至 44.7%、37.0% 提升至 38.5%,并登顶 DABStep 公开榜单。
OpenAI 发文指出 AI 正在快速进步,人类有机会塑造其发展方向,使其走向科学发现、安全以及惠及所有人的更好未来。
OpenAI 发布青少年安全蓝图,为负责任地构建 AI 提供路线图,涵盖安全防护、适龄设计与多方协作。该蓝图旨在保护并赋能年轻人在线使用 AI。
CRED 正与 OpenAI 合作,用 GPT 驱动的工具提升印度市场的高端客户体验,提高客服准确率、缩短响应时间并提升客户满意度。
Google 发布三项生物圈研究成果:与 World Resources Institute 合作开发森林砍伐驱动因素模型,以 1km² 分辨率覆盖 2000-2024 年,并开放 30 米尺度砍伐风险预测基准数据集。
Google 发布 ForestCast,用纯卫星数据训练的深度学习模型预测森林砍伐风险,并公开首个相关基准数据集。模型基于 vision transformers,仅用 Landsat 和 Sentinel 2 卫星数据及"变化历史"输入,精度可匹配或超过依赖道路等专用地图的传统方法。研究显示"变化历史"是最关键输入,单独使用即可达到与全量原始卫星数据相当的精度。
Chime CMO Vineet Mehra 分享了 AI 如何将营销重塑为智能体驱动的模式。他认为,优先提升 AI 素养并审慎采用 AI 的领导者将推动增长。
OpenAI 宣布全球企业客户已超过 100 万家,ChatGPT 和其 API 正被用于医疗健康、生命科学、金融服务等领域的工作场景。
Google 公布名为 Project Suncatcher 的研究计划,设想由太阳能卫星组成星座、搭载 Google TPU 并通过自由空间光链路互联,相关预印本论文探讨了卫星间高带宽通信、轨道动力学和辐射对计算的影响。
推荐理由:Google 公开了太空 AI 数据中心的系统设计与关键挑战,读者可了解其轨道、通信和 TPU 抗辐射的初步验证结果。
OpenAI 发布 IndQA,一个用于评估 AI 系统在印度语言中表现的新基准,由领域专家参与构建,覆盖 12 种语言和 10 个知识领域,重点考察文化理解与推理能力。
OpenAI 与 AWS 宣布达成多年期、金额 380 亿美元的战略合作,用于扩展先进 AI 工作负载。AWS 将提供基础设施与算力,支撑 OpenAI 下一代模型。
推荐理由:OpenAI 与 AWS 签下 380 亿美元多年协议,读者可据此观察前沿模型算力供应格局的变化。
一篇新文章提出用"分治法"替代时序差分(TD)学习来做 off-policy 强化学习,通过将轨迹对半切分并组合子段价值来更新价值函数,理论上把 Bellman 递归次数从线性降到对数级。作者与 Aditya 合作的工作首次将分治式价值学习扩展到 goal-conditioned RL 这类复杂任务,并给出基于三角不等式的传递性 Bellman 更新规则。难点在于如何选取最优子目标 w。
Google Research 在 Research@ 活动上公布三项进展:Earth AI 整合地理空间模型与 LLM 推理,其河流洪水模型覆盖 150 个国家超 20 亿人;开源癌症变异识别工具 DeepSomatic 发表于 Nature Biotechnology,并与 Google DeepMind 联合发布 270 亿参数的单细胞分析基础模型 C2S-Scale。
OpenAI 将 Stargate 扩展至密歇根州,新建一座 1 吉瓦(one-gigawatt)园区,以强化美国 AI 基础设施。该项目将创造就业、带动投资,并支持中西部地区的经济增长。
OpenAI 推出 AI 安全研究员 Aardvark,可自主发现、验证并协助修复大规模软件漏洞。该系统目前处于 private beta 阶段,可报名参与早期测试。
Google Research 提出可证明隐私洞察(PPI),结合大语言模型、差分隐私(DP)和可信执行环境(TEE),在保证个体数据不可被查看、聚合结果匿名的前提下分析非结构化 GenAI 数据。
推荐理由:Google 把 LLM、差分隐私与 TEE 组合成可外部核验的隐私分析流程,读者可了解端侧 AI 数据如何在不暴露个体数据的前提下被统计。
MiniMax M2 在 post-training 的智能体对齐阶段提出,智能体泛化不只是适配新工具,而是要在工具信息、系统提示词、用户提示词、环境和工具返回等全流程扰动下保持稳定。团队因此采用 Interleaved Thinking,让思考过程贯穿任务全程而非仅在开头,并构建了面向全轨迹泛化的数据管线。M2 用户需保留包含思考步骤的完整会话历史,否则会出现性能差距。
OpenAI 详解支撑 ChatGPT Atlas 的新架构 OWL,其核心是将 Chromium 解耦,从而实现快速启动、丰富 UI 以及由 ChatGPT 驱动的智能体浏览。
Google Research 发布 StreetReaderAI 无障碍街景原型,基于 Gemini 构建 AI Describer 与 AI Chat 两个子系统,为盲人和低视力用户实时生成道路、路口与地点的语音描述,并支持语音或键盘平移、移动和跳转。
Hugging Face 发布长文分析全球 AI 算力格局的变化,指出中国开源权重模型的推理已开始由华为昇腾、寒武纪等国产芯片承载,部分模型开始用国产芯片训练。
推荐理由:梳理美国出口管制与中国国产芯片、开源模型之间的因果链,并给出从硬件到软件栈的替代进展时间线。