BBVA 与 OpenAI 合作推进全球银行业 AI 转型
BBVA 扩大与 OpenAI 的合作,启动多年期 AI 转型计划,向全部 12 万名员工部署 ChatGPT Enterprise。双方将共同开发 AI 解决方案,用于改善客户交互、简化运营流程,并打造 AI 原生银行体验。
BBVA 扩大与 OpenAI 的合作,启动多年期 AI 转型计划,向全部 12 万名员工部署 ChatGPT Enterprise。双方将共同开发 AI 解决方案,用于改善客户交互、简化运营流程,并打造 AI 原生银行体验。
llama.cpp server 新增 router 模式,无需重启即可动态加载、卸载和切换多个模型,实现类似 Ollama 的模型管理。该模式采用多进程架构,每个模型独立运行,单个模型崩溃不影响其他模型;模型按需加载,超过 --models-max(默认 4)时按 LRU 策略卸载最久未用的模型。
推荐理由:llama.cpp server 新增 router 模式,读者可据此了解本地多模型热切换与显存回收的具体做法。
OpenAI 发布 GPT-5.2,称其为该公司在数学与科学方面最强的模型,在 GPQA Diamond 和 FrontierMath 等基准上刷新 SOTA。官方表示这些提升已转化为实际研究进展,包括解决一个开放理论问题并生成可靠的数学证明。
推荐理由:OpenAI 官方给出 GPT-5.2 在数学与科学基准上的新 SOTA 结果,并说明其已用于解决一个开放理论问题。
Google DeepMind 宣布与英国 AI Security Institute(AISI)签署新谅解备忘录,将合作从模型测试扩展到基础安全与安全研究。双方将共享专有模型、数据与思路,并联合发布报告,重点研究 CoT 监控、社会情感错位影响以及 AI 对经济系统的冲击。Google DeepMind 称 Gemini 3 是其迄今最智能、最安全的模型。
OpenAI 更新 GPT-5 系统卡,将 GPT-5.2 纳入其中。GPT-5.2 是 GPT-5 系列的最新模型家族,其安全缓解方案与 GPT-5 系统卡、GPT-5.1 系统卡所述基本一致。这些模型与 OpenAI 其他模型一样,训练数据包括互联网公开信息、通过第三方合作获取的信息,以及用户或人类训练师与研究人员提供或生成的信息。
推荐理由:官方系统卡更新披露 GPT-5.2 的安全缓解思路与 GPT-5 系列保持一致,可对照前代系统卡了解其安全策略延续性。
Podium 基于 OpenAI 的 GPT-5 构建了 AI 队友 "Jerry",为 10,000+ 中小企业提供服务,并带来 300% 的增长。该智能体正在改变 Main Street 商家服务客户的方式。
OpenAI 回顾了十年发展历程,从早期研究突破到被广泛使用的 AI 系统,并分享了这十年的经验教训。OpenAI 表示仍对构建造福全人类的 AGI 保持乐观。
OpenAI 发布 GPT-5.2,定位为面向日常专业工作的前沿模型,具备领先的推理、长上下文理解、编码和视觉能力。该模型已在 ChatGPT 和 OpenAI API 中提供,用于支持更快、更可靠的智能体工作流。
推荐理由:官方给出 GPT-5.2 在推理、长上下文、编码与视觉上的定位,可据此判断日常专业工作与智能体流程的可用性。
Hugging Face 发布教程,展示如何用 Hugging Face Skills 让 OpenAI Codex 端到端完成机器学习实验:微调 Qwen3-0.6B、用 HumanEval 评测、生成训练报告并导出 GGUF。
推荐理由:以完整实验流程展示编码智能体如何端到端完成微调、评测与部署,可迁移到自己的训练任务。
迪士尼与 OpenAI 达成协议,将 200 多个迪士尼、Marvel、Pixar 和 Star Wars 角色引入 Sora,用于粉丝创作的短视频。协议强调娱乐领域的负责任 AI,同时包含迪士尼在全公司范围使用 ChatGPT Enterprise 和 OpenAI API。
推荐理由:迪士尼与 OpenAI 的授权协议把 200 多个 IP 角色接入 Sora,并附带企业级 ChatGPT 采购,可观察内容版权与生成式视频的合作模式。
Google Research 在 COLM 2025 论文中提出 Urania 框架,通过差分隐私(DP)聚类与 DP 关键词提取,从 LLM 聊天机器人对话中生成使用洞察,且 LLM 只接触匿名关键词、不接触原始对话。与基于 CLIO 的非隐私基线 Simple-CLIO 相比,其隐私摘要在人工评估中最高有 70% 的情况更受 LLM 评审青睐,但隐私预算收紧时主题覆盖度会下降。
Google DeepMind 宣布深化与英国政府合作,向英国科学家优先开放 AlphaEvolve、AlphaGenome、AI co-scientist 和 WeatherNext 等"AI for Science"模型,并将于 2026 年在英国建立其首个自动化材料科学实验室。
OpenAI 正在针对 AI 模型网络安全能力增强的趋势,投入更强的防护措施与防御能力。公司说明了其评估风险、限制滥用的方式,并与安全社区合作提升网络韧性。
Scout24 基于 GPT-5 打造了一款对话式助手,通过追问澄清、生成摘要和个性化房源推荐,重新定义房产搜索体验。
Mistral AI 发布新一代编码模型系列 Devstral 2,含 123B 的 Devstral 2 和 24B 的 Devstral Small 2,分别采用修改版 MIT 和 Apache 2.0 许可,均为开源。
推荐理由:官方给出两款开源编码模型的参数、许可与 SWE-bench 成绩,并附与闭源模型的对比评测,可据此判断开源编码智能体的当前水位。
Google DeepMind 联合 Kaggle 发布 FACTS Benchmark Suite,在原有 FACTS Grounding 基础上新增 Parametric、Search、Multimodal 三项基准,并将 Grounding 升级至 v2,共 3513 个公开样例,另设私有留出集。
OpenAI 在 Linux 基金会下联合创立 Agentic AI Foundation,并将 AGENTS.md 捐赠给该基金会。此举意在支持面向安全智能体 AI 的开放、可互操作标准。
OpenAI 推出首批 OpenAI Certifications 认证及 AI Foundations 课程,帮助人们建立实用 AI 技能、提升职业机会并为未来工作做准备。
OpenAI 任命 Denise Dresser 为首席营收官,负责统筹其全球营收战略,覆盖企业业务与客户成功。她将帮助更多企业把 AI 应用到日常运营中,配合 OpenAI 的持续扩张。
澳大利亚联邦银行与 OpenAI 合作,向 5 万名员工部署 ChatGPT Enterprise,以大规模提升 AI 应用能力。该行希望借此改善客户服务与欺诈响应。
OpenAI 与 Deutsche Telekom 合作,为欧洲数百万用户带来先进的多语言 AI 体验。Deutsche Telekom 还将部署 ChatGPT Enterprise,帮助员工改进工作流程、加速创新。
Instacart 与 OpenAI 深化长期合作,将首个完整集成的生鲜购物与 Instant Checkout 支付应用引入 ChatGPT。用户可在 ChatGPT 内完成生鲜选购与即时结账。
OpenAI 基于企业数据发布的报告显示,2025 年各行业 AI 采用正在加速,集成程度加深并带来可衡量的生产力提升。
Virgin Atlantic 正在用 AI 加速开发、改进决策并提升客户体验,其 CFO Oliver Byers 分享了具体做法。该航司将 AI 应用于旅行全流程的各个环节。
Hugging Face 推出 swift-huggingface,一个面向 Hub 的完整 Swift 客户端包,可独立使用,后续将并入 swift-transformers 替换现有 HubApi。它提供完整 Hub API 覆盖、断点续传与进度追踪、与 Python 兼容的共享缓存,以及 TokenProvider 认证和 OAuth 2.0 支持,基于分块去重的 Xet 存储后端即将上线。
Google Research 发布两篇论文,提出 Titans 架构与 MIRAS 理论框架,将 RNN 的速度与 Transformer 的精度结合,实现测试时记忆。
推荐理由:Google Research 提出 Titans 架构与 MIRAS 框架,用深度神经网络做长期记忆模块,为超长上下文建模提供新思路。
OpenAI 宣布推出 OpenAI for Australia,用于建设主权 AI 基础设施、为超过 150 万名工作者提供技能提升,并加速澳大利亚 AI 生态的创新。
密歇根州立大学 Berkley Walker 团队借助 AlphaFold 预测植物与嗜热藻类的甘油酸激酶(GLYK)三维结构,发现植物版 GLYK 的三个柔性环在高温下变形失稳。他们将藻类 GLYK 中更刚性的环替换进植物酶,构建的杂合酶中有一个在高达 65 °C 下仍保持稳定,为培育耐热作物提供了路径。
Intel AI Software Group 推出 DeepMath,一个基于 Qwen3-4B Thinking、用 GRPO 微调并在 smolagents 上实现的数学推理 Agent,通过生成 Python 片段在沙箱中执行来替代冗长文本推理。
Hugging Face 发布 Hugging Face Skills,让 Claude Code、Codex、Gemini CLI 等编码智能体直接提交云端 GPU 训练任务、监控进度并把模型推到 Hub。
推荐理由:官方给出从数据校验到 GGUF 转换的完整训练链路,可据此判断对话式微调的实际边界与成本。
Google Research 在 NeurIPS 2025 发布 Massive Sound Embedding Benchmark(MSEB),用于标准化评估声音嵌入模型的 8 类听觉能力,涵盖检索、推理、分类、转录、分割、聚类、重排序与重建。
OpenAI 宣布收购 Neptune,以加深对模型行为的可见性,并强化研究人员用于追踪实验和监控训练的工具。
OpenAI 研究人员正在测试一种名为"confessions"的方法,训练模型在犯错或做出不当行为时主动承认,以提升 AI 的诚实性、透明度以及模型输出的可信度。
OpenAI Foundation 公布 People-First AI Fund 首批受资助名单,向 208 家非营利组织提供总额 4050 万美元的无限制资助,用于支持社区创新与机会。
Mistral 发布 Mistral 3 系列,包括 14B、8B、3B 三个小尺寸稠密模型和迄今最强的 Mistral Large 3,后者为稀疏 MoE 架构,41B 激活参数、675B 总参数,全部以 Apache 2.0 许可开源。
推荐理由:Mistral 3 一次性开源从 3B 到 675B 的完整模型族,读者可据此了解开源模型在参数规模与部署形态上的最新覆盖范围。
Mirakl 正借助 AI 智能体与 ChatGPT Enterprise 重塑电商,实现更快的文档撰写和更智能的客户支持,并推进 Mirakl Nexus 构建智能体原生电商。
OpenAI 拨款最高 200 万美元,资助 AI 与心理健康交叉领域的研究。该计划支持研究现实世界中的风险、收益与应用,以提升安全性和福祉。
OpenAI 与 NORAD 合作为“NORAD Tracks Santa”推出三款 ChatGPT 节日工具,让家庭可以生成节日精灵、玩具涂色页和定制圣诞故事。
OpenAI 入股 Thrive Holdings,将前沿研究与工程能力直接嵌入会计和 IT 服务,以提升速度、准确性和效率。此举旨在打造可规模化的行业转型模式,推动企业级 AI 的广泛应用。
Accenture 与 OpenAI 正展开合作,帮助企业将智能体 AI 能力引入业务核心,以释放新的增长空间。