Cognition 借助 GPT‑6 Astra 让 Devin 自测代码
Cognition 用 GPT‑6 Astra 提升 Devin 测试软件并证明其可用的能力,目标是让工程师少审代码、多交付。
Cognition 用 GPT‑6 Astra 提升 Devin 测试软件并证明其可用的能力,目标是让工程师少审代码、多交付。
César de la Fuente 的实验室利用 Codex 和 ChatGPT 在现存与已灭绝生物的基因组中搜寻抗菌候选分子,以对抗耐药性感染。
OpenAI 宣布 ChatGPT Work 中的 Data agent 面向所有人开放,可连接公司数据、发现洞察,并用自然语言让 AI 构建交互式仪表盘。
推荐理由:OpenAI 官方给出 ChatGPT Work 中 Data agent 的定位,读者可据此了解企业数据接入与看板生成的新入口。
OpenAI 推出面向金融服务的 ChatGPT,内置金融数据并接入 GPT-6 Astra,用于研究、建模和生成可直接交付客户的材料。
推荐理由:官方给出金融场景的产品定位与内置数据、模型组合,可据此判断 ChatGPT 在金融工作流中的切入点。
Hugging Face 发布 Workflow1111,用 Gradio Workflow 把 AUTOMATIC1111 的大部分功能重建为一张工作流画布,由 11 条媒体管线和 73 个节点组成,覆盖文生图、高清修复、图生图、提示词矩阵、VLM 反推、检测生成 inpaint 掩码、ControlNet 风格标注器、背景移除、PNG Info 与图生视频。
推荐理由:原文给出用 Gradio Workflow 重建 A1111 全部管线的节点构成与运行方式,可据此判断无 GPU 搭建多模型工作流的可行性。
OpenAI 发布 Agents API,这是一个由 Codex harness 驱动的托管服务,用于构建和上线云端智能体。该服务支持编排、长时间运行的会话以及工具调用。
推荐理由:OpenAI 官方给出 Agents API 的托管定位与 Codex harness 编排能力,可据此判断云端智能体的搭建方式。
MIT 研究人员使用 GPT-5.6 Sol 配合 Codex,自主运行量子计算实验、分析结果并校准量子比特。该案例展示了 GPT-5.6 Sol 在量子计算实验流程中的实际应用方式。
Google DeepMind 发布 AlphaGenome Atlas,一个包含人类基因组中 90 亿个单核苷酸变异效应预测的平台,规模达 1PB,是 AlphaFold Database 的 30 倍以上,今日起通过网站门户、AlphaGenome API 和 Google Antigravity 中的 skill 向学术研究免费开放。
推荐理由:DeepMind 把 AlphaGenome 的预测预计算成覆盖全基因组的可检索图谱,读者可了解其数据规模与开放方式。
1Password 的工程师使用 Codex 快速构建新功能和内部工具,在维持严格安全策略的同时达到生产可用状态,工程效率提升 21%。
GitHub 发布研究预览 Project HydraFusion,在 GitHub Copilot CLI 中通过运行时编排多个提供商的模型,自动选择 Single、Cascade、Critique 三种执行模式来平衡质量、成本与延迟。
推荐理由:GitHub 官方给出 HydraFusion 的三种编排模式与三个基准上的质量成本对照,可据此判断多模型编排在编码任务中的取舍。
Playco 借助 GPT-6 Astra,从一个灰盒基础版本构建了三款主题游戏原型,人工修复量比使用上一代模型减少 50%。
Legora 借助 GPT-6 Astra 在数分钟内审阅了 41 份文档,找出了全部四处预设错误,并在该财务审阅工作流中把性能提升近 40%。
Hugging Face 发布 funes,一个为 Claude Code、Codex、pi 和 Hermes 等编码智能体提供持久记忆的本地层,从本机已有会话构建索引,一条命令即可接入。
推荐理由:funes 把编码智能体的历史会话变成可检索的本地记忆,读者可据此判断跨机器、跨智能体协作的可行路径。
Google 推出 Fairwind Program,限量向 Google Cloud 客户、政府机构和网络安全合作伙伴开放其最先进的网络防御能力,首批提供 Gemini 3.8 Flash Cyber 模型配合 CodeMender 工具链,用于自主发现、验证并修复漏洞。
推荐理由:Google 把前沿网络安全模型以限量计划形式开放给政府和关键基础设施,读者可了解其能力边界与准入条件。
ATV Big Air Tour 使用 ChatGPT Work 加速营销与周边商品业务,将原本 3 天的工作量缩短到 3 小时。该团队还用它在 15 分钟内把商品照片变成了一个库存网站。
Google DeepMind 在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 上推出智能体视频理解功能,视频分析 token 消耗最多降低 88%、成本最多降低 66%、准确率最多提升 7%。
推荐理由:官方给出视频分析在 token 消耗、成本与准确率上的量化变化,以及 API 启用方式,便于开发者评估是否迁移现有视频处理流程。
Basis、Clay 和 Exa Labs 正用 AI 智能体改进客户入驻、账户管理和开发者集成。这些 AI 原生公司的实践展示了企业领导者可以借鉴的运营能力建设路径。
OpenAI 宣布医疗机构可将 EHR 及其他行业数据接入 ChatGPT,帮助临床医生安全访问患者上下文、医学研究等信息。该能力面向医疗场景,强调数据连接的可信与安全。
澳大利亚律所 Gilbert + Tobin 通过 CEO 主导的投入、严格治理与人工问责机制,在全所范围内规模化部署 ChatGPT Enterprise 和 Codex。
Hugging Face 发布 @huggingface/kernels,一个从 Hub 加载并运行优化 WebGPU kernel 的 JavaScript 库,同时上线 207 个 Apache-2.0 许可的 kernel,每个都以独立仓库形式发布,包含 manifest、正确性用例、基准用例和 WGSL 着色器模板。
Voice Arena 与 Hugging Face 合作,在 Open ASR Leaderboard 上新增 Monsoon en-IN 和 Monsoon hi-IN 两个评测集,印地语成为该多语言榜单上的首个印度语言。
ChatGPT for Teachers 扩展至 55 个美国学校系统,为超过 10 万名教育工作者和员工提供安全的 AI 工具、培训与支持。
loveholidays 借助 OpenAI Codex 让公司内部各团队都能参与软件开发,把想法更快变成产品。该案例展示了 Codex 如何降低开发门槛,使非工程岗位也能承担构建工作。
OpenAI 为 ChatGPT Work 和 Codex 推出 Admin 插件,可分析工作区用量、管理成员与权限、调整限额并处理管理请求。该插件面向管理员,将日常管理操作集中在一处完成。
Gradio 内置的 gr.Workflow 把多步 AI 流水线描述为带类型节点的图,Gradio 会提供一个拖拽画布,每个节点可运行、每个中间结果可见。同一张图同时是 REST API,每个输出按标签生成独立端点,并支持一条命令部署到 Hugging Face Spaces。
推荐理由:Gradio 把多步 AI 流水线做成可拖拽的图,并自动暴露 REST 接口,读者可据此判断现有 Python 拼接流程的改造成本。
GPT‑5.6 现已在 Kiro 中可用,帮助开发者完成软件的规划、构建、审查与测试,并带来更好的性价比。
Liquid AI 为 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 和 LFM2.5-8B-A1B 发布 DSpark 草稿模型检查点,通过投机解码在不改变输出质量的前提下提升吞吐,GPU 上最高 3.18 倍、端侧最高 2.87 倍。
推荐理由:Liquid AI 给出三个 LFM2.5 模型的 DSpark 草稿模型与 H100、MacBook 实测吞吐数据,可据此判断投机解码在端侧与 GPU 上的实际收益。
Mistral 发布 Agentic Search,一个面向企业复杂文档的多步检索层,通过 Mistral Search Toolkit 提供,并内置于 Studio 和 Vibe 的 Libraries 中。
推荐理由:原文给出多步检索循环的工具设计与两组基准数字,可对照一次性 RAG 理解检索层的变化。
Stampli 借助 Codex 和 ChatGPT Work,在固定截止日期、设计资源投入他处的情况下,把原本数周的发布制作压缩到数天,发布工时减少 68%。
ChatGPT Ads 正在扩展至 31 个欧洲市场,广告主可在用户探索、比较选项和做出决策的过程中触达他们。
OpenAI 推出 ChatGPT for Teens,定位是帮助青少年学习、批判性思考并更有信心地使用 AI。该版本内置更强的保护措施和健康使用功能,并为家长提供额外控制选项。
Asana 用 OpenAI Codex 在两周内替换了陈旧的测试系统,模型与基础设施成本约 1.2 万美元。这项原本预计耗时数年的代码迁移因此大幅提速。
NVIDIA 团队使用 ChatGPT Work 减少手动任务、连接快速变化的信号,并在全球范围内规模化推广成功的工作流。
Sentence Transformers v6.0 新增第四种模型类型 MultiVectorEncoder,用于 ColBERT 式晚交互检索,PyLate 与 Stanford-NLP ColBERT 检查点可直接加载,colpali-engine 的视觉文档检索模型也能通过同一套 API 使用。
推荐理由:Sentence Transformers v6.0 新增多向量编码器,读者可据此判断晚交互检索的接入方式与索引成本。
OpenAI 预览新的 API 服务层 Ultrafast,运行 GPT-5.6 Sol 时最高提速 14 倍。该服务由 Cerebras 提供算力支持,输出速度最高可达每秒 750 个 token。
RingCentral 借助 ChatGPT Work 与 Codex 加速 AI 产品开发,并在工程与运营之间集中化运营智能。该实践覆盖从工程到运营的 AI 原生工作方式。
Mistral 宣布三项推进 AI 主权的举措:Mistral Regional Endpoints 正式可用,客户可选择推理在欧洲或美国运行;Mistral Priority Tier 进入公开预览,为关键业务负载提供自定义速率限制和带 SLA 的可用性承诺。
推荐理由:Mistral 把区域推理、SLA 保障和第三方开源模型接入放进同一套基础设施,读者可据此判断企业级部署的合规与算力选项。
OpenAI 与 AWS 将 Daybreak 网络安全能力通过 Amazon Bedrock 提供,用于支持企业安全相关工作流。
Model ML 借助 GPT-5.6 Sol 将金融工作从研究与分析一路推进到可编辑、可追溯的 PowerPoint 演示文稿和 Excel 工作簿。
Zapier 企业营销团队使用 ChatGPT Work 减少线索漏斗流失、制作营销活动素材并自动化报告。