Zenken 用 ChatGPT Enterprise 提升精简销售团队效率
Zenken 全公司部署 ChatGPT Enterprise 后,销售业绩提升、准备时间缩短、提案成功率提高。AI 支持的工作流帮助这支精简团队实现更个性化、更有效的客户互动。
Zenken 全公司部署 ChatGPT Enterprise 后,销售业绩提升、准备时间缩短、提案成功率提高。AI 支持的工作流帮助这支精简团队实现更个性化、更有效的客户互动。
Google Research 在 Science Advances 发表论文,介绍混合模型 NeuralGCM 直接使用 NASA 2001 至 2018 年卫星降水观测训练其机器学习部分,而非依赖再分析数据。
伯克利 AI Research 提出一套基于互信息的成像系统评估与优化框架,可直接从含噪测量中估计信息量,预测系统性能。在彩色摄影、射电天文、无镜头成像和显微成像四个领域验证中,该指标正确排序了不同硬件设计,优化后性能匹配 SOTA 端到端方法,且内存与算力需求更低、无需任务专用解码器设计。
OpenAI 与软银集团合作,联合 SB Energy 开发多吉瓦级 AI 数据中心园区,其中包括一座位于德克萨斯州、容量 1.2 GW 的设施,用于支持 Stargate 计划。
Datadog 采用 OpenAI 的 Codex 进行系统级代码审查。该做法将 Codex 用于跨系统的代码审查场景,而非仅限单文件或局部改动。
OpenAI 推出 OpenAI for Healthcare,提供安全的企业级 AI 并支持 HIPAA 合规。该方案旨在减轻行政负担并支持临床工作流。
Netomi 借助 GPT-4.1 和 GPT-5.2 扩展企业级 AI 智能体,通过并发、治理与多步推理支撑可靠的生产工作流。该方案面向企业规模化部署场景,强调智能体系统在生产环境中的稳定性。
Tolan 基于 GPT-5.1 构建了一款语音优先的 AI 伴侣,结合低延迟响应、实时上下文重建和记忆驱动的人格设定,实现自然对话。
OpenAI 推出 ChatGPT Health,这是一个可安全连接个人健康数据与应用的独立体验。官方称其具备隐私保护措施,并采用由医生参与设计的方案。
推荐理由:OpenAI 官方给出 ChatGPT Health 的定位与隐私设计,读者可据此判断健康数据接入的边界。
NVIDIA 发布开源推理视觉语言模型 Cosmos Reason 2,在 Physical AI Bench 和 Physical Reasoning 榜单上成为排名第一的开源视觉理解模型。
推荐理由:Cosmos Reason 2 把上下文从 16K 提到 256K 并新增轨迹与 OCR 能力,可据此判断物理 AI 视觉推理的可用边界。
TII 发布 Falcon-H1-Arabic 阿拉伯语模型家族,包含 3B、7B、34B 三个参数版本,采用在每个 block 内并行运行 Mamba 状态空间模型与 Transformer 注意力的 Falcon-H1 混合架构。
推荐理由:原文给出三个参数规模的架构、上下文窗口与基准对比,可据此判断阿拉伯语模型的部署选型。
NVIDIA 在 CES 2026 发布博客,给出用 DGX Spark 加 Reachy Mini 复现黄仁勋主题演讲中桌面智能体的分步教程,源码已开源。
推荐理由:完整复现路径覆盖模型选型、路由与工具调用,可据此搭一套本地私有桌面智能体。
OpenAI Grove 第二期现已开放申请,这是一个为期 5 周的创始人项目,面向从仅有想法到已有产品的任何阶段参与者。入选者可获得 5 万美元 API 额度、AI 工具早期访问权限以及 OpenAI 团队的实操指导。
Google 回顾 2025 年在 8 个领域的研究突破,模型方面 3 月发布 Gemini 2.5、11 月推出 Gemini 3、12 月推出 Gemini 3 Flash,其中 Gemini 3 Pro 登顶 LMArena 并在 MathArena Apex 取得 23.4% 的 SOTA。
ServiceNow 发布 AprielGuard,一个 8B 参数的安全与安全防护模型,可检测 16 类安全风险以及提示词注入、越狱、思维链污染、上下文劫持、记忆投毒和多智能体攻击序列等对抗攻击。
OpenAI 宣布全球客户数已超过 100 万。PayPal、Virgin Atlantic、BBVA、Cisco、Moderna 和 Canva 等公司正在用 OpenAI 改变工作方式。
Google Research 回顾 2025 年成果:Gemini 3 成为其最强、最注重事实准确性的 LLM,在 SimpleQA Verified 和与 Google DeepMind、Kaggle 联合发布的新 FACTS 基准上达到 SOTA。
OpenAI 推出面向思维链可监控性的新框架与评测套件,覆盖 24 种环境下的 13 项评估。结果显示,监控模型内部推理远比仅监控输出更有效,为 AI 系统能力提升后的可扩展控制提供了可行路径。
OpenAI 更新 Model Spec,新增 Under-18 Principles,规定 ChatGPT 应基于发展科学为青少年提供安全、适龄的引导。此次更新强化了防护栏,并明确了模型在更高风险情境下的预期行为,是其改善 ChatGPT 青少年安全整体工作的一部分。
OpenAI 与美国能源部签署谅解备忘录,深化在 AI 与先进计算领域的合作,以支持科学发现。该协议基于双方与美国国家实验室的现有合作,旨在建立将 AI 应用于能源部生态系统中高影响力研究的框架。
OpenAI 发布面向青少年与家长的 AI 素养资源,帮助其更审慎、安全且有信心地使用 ChatGPT。指南包含经专家审核的建议,涵盖负责任使用、批判性思维、健康边界,以及如何支持青少年应对情绪或敏感话题。
Hugging Face 在 Transformers v5 中重构了 tokenizer 设计,将 tokenizer 架构与训练好的词表分离,类似 PyTorch 将网络架构与学习权重分离。v5 提供更清晰的内部结构、干净的类层级和单一快速后端,让用户能检查、定制或从零训练模型专属 tokenizer,而非将其视为黑盒。
OpenAI 发布 GPT-5.2-Codex,称其为该公司最先进的编码模型。该模型主打长程推理、大规模代码转换以及增强的网络安全能力。
推荐理由:OpenAI 官方发布新一代编码模型,读者可据此了解其在长程推理与大规模代码改造上的定位。
OpenAI 发布 GPT-5.2 系统卡增补文件,涉及 GPT-5.2-Codex。该页面为 OpenAI News 官方条目,正文内容未能抓取,仅标题可用。
Mistral AI 发布 Mistral OCR 3,在表单、扫描文档、复杂表格和手写内容上相对 Mistral OCR 2 的整体胜率为 74%,并称其准确率超过企业文档处理方案与 AI 原生 OCR 方案。
推荐理由:官方给出与上一代在表单、手写和表格上的胜率对比,以及每千页定价,可据此判断文档解析成本与适用场景。
NVIDIA 发布 Nemotron 3 Nano 30B A3B,并公开其完整评测配方,基于开源库 NeMo Evaluator 构建,任何人可重跑评测流程并独立核验结果。
Google DeepMind 发布 Gemini 3 Flash,将 Gemini 3 的推理能力与 Flash 级延迟和成本结合,定价为每 100 万输入 token 0.50 美元、每 100 万输出 token 3 美元。
推荐理由:官方给出 Gemini 3 Flash 的基准分数、定价与上线渠道,可据此判断它在速度与成本上的取舍。
OpenAI 联合 American Journalism Project 和 The Lenfest Institute 推出 OpenAI Academy for News Organizations,这是一个帮助新闻编辑室有效使用 AI 的学习中心。该 Academy 提供培训、实用案例和负责任使用指南,支持记者、编辑和出版方在报道与运营中采用 AI。
OpenAI 宣布开发者可以向 ChatGPT 提交应用,经审核通过后会在产品内的新应用目录中展示。官方同时更新了工具、指南和 Apps SDK,用于构建把真实操作带入 ChatGPT 的对话原生体验。
推荐理由:OpenAI 开放 ChatGPT 应用提交入口并给出 Apps SDK 与审核规范,开发者可据此判断接入路径。
OpenAI 发布企业 AI 应用现状报告,基于数据展示各组织如何从试验阶段走向实际生产力提升与新能力构建。
Google DeepMind 发布 Gemma Scope 2,一套面向 Gemma 3 全系列(270M 至 27B 参数)的开源可解释性工具,结合稀疏自编码器(SAE)与 transcoder 查看模型内部计算。
推荐理由:Gemma Scope 2 覆盖 Gemma 3 全系列并提供 SAE 与 transcoder,读者可据此了解模型可解释性工具的开源进展。
OpenAI 发布 FrontierScience 基准,用于测试 AI 在物理、化学和生物学领域的推理能力,衡量其向真实科学研究迈进的进展。
OpenAI 推出一个真实世界评估框架,用于衡量 AI 在湿实验室中加速生物研究的能力。该工作使用 GPT-5 优化分子克隆实验方案,同时探讨了 AI 辅助实验的前景与风险。
OpenAI 提出企业构建"AI-ready"组织的路径,涵盖清晰的战略、培训、治理与加速创新四个方面。内容面向领导者,说明如何借助这些要素让组织适应 AI 时代。
Google Research 为 STOC 2026 推出实验性 Paper Assistant Tool(PAT),基于 Gemini 2.5 Deep Think 的推理扩展方法,在投稿后 24 小时内为作者生成结构化预审反馈,涵盖论文贡献摘要、潜在错误与改进建议以及笔误清单。
推荐理由:Google 官方披露 PAT 在 STOC 2026 的实测数据与作者反馈,可了解 AI 辅助数学证明审阅的实际边界。
IBM 开源的可配置通用智能体 CUGA 上线 Hugging Face Spaces,提供 CRM 演示和 20 个预置工具,用于销售数据查询与 API 交互。
推荐理由:CUGA 在 AppWorld 与 WebArena 上的成绩和 20 个预置工具的演示,能帮读者判断可配置智能体的落地方式。
Google DeepMind 发布升级版 Gemini 2.5 Flash Native Audio,面向实时语音智能体,改进函数调用、指令遵循与多轮对话能力。
推荐理由:官方给出函数调用、指令遵循与多轮对话三项改进的具体分数,可据此判断语音智能体的可用性提升。
Google 联合 SisonkeBiotik、Ro'ya 和 DS-I Africa 举办非洲健康数据科学 Ideathon,从 30 多份提交中选出六支决赛团队,使用 MedGemma、TxGemma 和 MedSigLIP 等开放健康 AI 模型开发解决方案。
OpenAI 借助 Codex 在 28 天内完成 Android 版 Sora 的交付,通过 AI 辅助的规划、翻译与并行编码工作流,让一支精干团队实现快速且可靠的开发。
BNY 利用 OpenAI 在全企业范围扩大 AI 应用,通过 Eliza 平台让 20,000 多名员工构建 AI 智能体,以提升效率和客户成果。