OpenAI 与 CodeAI 合作培养第一代 AI 素养学生
OpenAI 与 CodeAI 达成合作,帮助学生建立 AI 素养、批判性思考 AI,并培养负责任地使用和塑造 AI 的技能。
OpenAI 与 CodeAI 达成合作,帮助学生建立 AI 素养、批判性思考 AI,并培养负责任地使用和塑造 AI 的技能。
OpenAI 推出 ChatGPT for Teens,定位是帮助青少年学习、批判性思考并更有信心地使用 AI。该版本内置更强的保护措施和健康使用功能,并为家长提供额外控制选项。
Asana 用 OpenAI Codex 在两周内替换了陈旧的测试系统,模型与基础设施成本约 1.2 万美元。这项原本预计耗时数年的代码迁移因此大幅提速。
NVIDIA 团队使用 ChatGPT Work 减少手动任务、连接快速变化的信号,并在全球范围内规模化推广成功的工作流。
Sentence Transformers v6.0 新增第四种模型类型 MultiVectorEncoder,用于 ColBERT 式晚交互检索,PyLate 与 Stanford-NLP ColBERT 检查点可直接加载,colpali-engine 的视觉文档检索模型也能通过同一套 API 使用。
推荐理由:Sentence Transformers v6.0 新增多向量编码器,读者可据此判断晚交互检索的接入方式与索引成本。
Hugging Face 构建了一个约束感知的 GPU 分配器,在七个基准场景中与 FIFO 调度器对比,相同硬件和负载下 GPU 利用率最高提升 33 个百分点,优先级加权产出在每个场景均有提升,最高达 105%。
Import AI 第 469 期介绍了 DiG-bench(Discovery in Games)基准,包含 70 款规则与目标均隐藏、需靠交互探索发现的游戏,其中 21 款已公开。
Google 推出 PhotoScan,一个从普通 2D 手机照片估算体脂率(BF%)、Android-to-Gynoid 脂肪比(A/G)和 Visceral-to-Subcutaneous 脂肪面积比(V/S)的深度学习框架。
OpenAI 发文指出 AI 正在同时重塑攻击方与防御方的网络安全格局,并介绍其自身如何强化防御。文章同时给出安全团队当下可采取的行动建议。
OpenAI 加入 PORTS-Pike 项目,扩大社区投资,并支持俄亥俄州南部数千个就业岗位。
OpenAI 资助 14 个独立项目,探索智能时代的新 AI 政策思路,目标是扩大经济机会并增强社会韧性。
Hugging Face 发布 2026 年 1 月至 8 月的开源模型生态观察报告,基于 Hub 上的下载、点赞与衍生模型数据。报告显示公开模型仓库从 243 万增至 296 万,数据集从 71.1 万增至 100 万,Spaces 从 100 万增至 144 万,但 85.6% 的模型终身下载量不足 200 次,1.5% 的仓库占据 99.2% 的下载量。
推荐理由:Hugging Face 用平台下载、点赞与衍生模型数据,给出开源模型生态在规模、许可与采用上的半年变化。
AWS 开源 SDK Strands Robots(Apache 2.0)演示了一条流式数据闭环:用 Robot("so100") 录制 LeRobotDataset 并同步到 Hugging Face Storage Buckets。
Google DeepMind 发布 Gemini 3.7 Flash,定位为面向编码与智能体的最强主力模型,距 Gemini 3.6 Flash 仅三周。
推荐理由:Gemini 3.7 Flash 距上一版仅三周,价格降为一半,并给出编码与文档处理等多项基准对比,可据此判断升级幅度与成本变化。
OpenAI 发布 GPT-5.6 构建者指南,介绍初创公司如何借助更智能的模型选择与新版 Responses API 能力,构建更快、更具成本效率的 AI 智能体。
OpenAI 预览新的 API 服务层 Ultrafast,运行 GPT-5.6 Sol 时最高提速 14 倍。该服务由 Cerebras 提供算力支持,输出速度最高可达每秒 750 个 token。
OpenAI 任命 Dali Rajic 为首席营收官,负责领导其全球营收组织,并帮助企业充分实现 AI 的价值。
Hugging Face 在 7 月 15 日至 8 月 2 日举办 ICML 2026 开放复现挑战,1,221 名社区成员用 Claude Code、Codex、Cursor 等编码智能体逐条复现论文主张,共发布 6,816 份 Trackio logbook,覆盖 2,226 篇论文,约占会议论文的三分之一。
推荐理由:Hugging Face 用 1,200 多名社区成员和编码智能体复现 ICML 2026 论文,给出了大规模论文审计的可行路径与人类角色的具体观察。
Hugging Face 的 OlmoEarth Studio 现已支持计算并导出嵌入向量,用户可通过 UI 或 API 选择区域、时段、编码器变体(Nano 128 维 1.4M 参数、Tiny 192 维 6.2M 参数、Base 768 维 89M 参数)、分辨率及影像源,输出 int8 格式的 Cloud-Optimized GeoTIFF。
微软研究院发布 MindTopo 基准,用于评测多模态大模型在连通性、封闭性、顺序、分离和绳结五类拓扑关系上的推理与规划能力。测试显示,当前专有与开源模型在静态识别上明显强于交互规划,且两者均远低于人类水平,失败多发生在规划阶段而非感知阶段。图像与视频生成仅在单帧内保留拓扑关系时有用,跨多步操作仍不可靠。
Google DeepMind 发布大规模多语言手语转文本模型 SL2T,可将手语直接翻译为流式文本,首个支持场景为美国手语(ASL)转英文。该模型基于超过 50 种手语、逾 10 万小时数据训练,其中约四分之一为 ASL 数据,在 FLEURS-ASL(sd-test)上取得 70 BLEURT 的零样本成绩。
推荐理由:官方披露了 SL2T 的训练规模、手语翻译难点与端侧隐私方案,可了解手语 AI 从实验室走向消费产品的路径。
Google Research 发布研究,提出知识画像框架,把事实状态分为编码失败、召回失败、直接召回、思考后召回和无编码推理五类,并构建含 2,150 条 Wikipedia 事实、每条配 10 个问题的 WikiProfile 基准。
推荐理由:Google Research 用知识画像区分编码与召回失败,指出前沿模型的事实错误更多来自知识难以取用而非未存储。
OpenAI 研究揭示企业正采用智能体 AI,使用 ChatGPT 和 Codex 推进落地,前沿企业已在 AI 采用上拉开差距。
RingCentral 借助 ChatGPT Work 与 Codex 加速 AI 产品开发,并在工程与运营之间集中化运营智能。该实践覆盖从工程到运营的 AI 原生工作方式。
Google Research 发布 AMIE (Video),基于 Gemini 和 Project Astra 实现实时视频临床问诊,可感知非语言线索、引导虚拟体格检查并同步完成诊断推理。
推荐理由:Google 用 300 场随机对照视频问诊给出 AMIE 视频版与真人医生同级的评测结果,可了解多智能体异步架构如何兼顾对话延迟与临床推理。
微软研究院推出 CARE-X,一个面向胸部 X 光多种临床解读任务的统一视觉语言模型,结合生成式与结构化预测,并用强化学习(DAPO)在多任务设置下奖励临床正确性。该模型支持报告生成、病灶有无与否定判断、异常定位、多标签分类及导管位置检测等任务,采用生成或双推理模式。另一项独立实验中,Qwen3-VL-4B-Instruct 搭配确定性测量工具,用于评估直接计算能否改善测量依赖型病症的表现。
Hugging Face 的 ALTK-Evolve 与 ACE 同为无需权重更新的智能体记忆方案,但前者按任务检索少量高支持度 guideline,而非每步注入完整 playbook。
Mistral 宣布三项推进 AI 主权的举措:Mistral Regional Endpoints 正式可用,客户可选择推理在欧洲或美国运行;Mistral Priority Tier 进入公开预览,为关键业务负载提供自定义速率限制和带 SLA 的可用性承诺。
推荐理由:Mistral 把区域推理、SLA 保障和第三方开源模型接入放进同一套基础设施,读者可据此判断企业级部署的合规与算力选项。
OpenAI 与 AWS 将 Daybreak 网络安全能力通过 Amazon Bedrock 提供,用于支持企业安全相关工作流。
OpenAI 宣布开始在 ChatGPT 中测试广告,以支持免费访问。官方称广告会有清晰标注,不影响回答的独立性,并提供较强的隐私保护和用户控制选项。
推荐理由:OpenAI 官方说明在 ChatGPT 中测试广告的边界,读者可据此了解免费访问与广告之间的取舍。
OpenAI CFO Sarah Friar 分享了打造 AI 原生财务团队的五点经验,涵盖自动化预测、更强的管控以及 AI 投资回报率(ROI)。
NVIDIA 发布 Magpie TTS Multilingual,一个 364M 参数的开源权重语音合成模型,支持 12 种语言,新增现代标准阿拉伯语、韩语和巴西葡萄牙语,并通过更新训练数据提升了多种既有语言的质量。
推荐理由:原文给出 364M 开源权重模型的多语言覆盖与 TTFA 实测数据,可据此判断自建语音链路的延迟与部署方式。
OpenAI 向得克萨斯州州长 Greg Abbott 致信,阐述其在得州推进负责任 AI 基础设施的承诺。信中支持可靠、透明的增长方式,以惠及得州民众。
Import AI 第 468 期收录智库 IFP 提出的 23 条政策建议,分属 7 个类别,用于帮助政策制定者应对 AI 研发进一步自动化带来的风险。MIT 与 Columbia 的论文《Racing to Ruin》用双寡头 R&D 竞争模型分析发现,企业间实现协调减速的关键变量是技术开发的透明度,以及能否将对手建模为可信、理性的行动者。
Model ML 借助 GPT-5.6 Sol 将金融工作从研究与分析一路推进到可编辑、可追溯的 PowerPoint 演示文稿和 Excel 工作簿。
Hugging Face 论文提出两项系统改动降低 LLM 知识蒸馏成本:离线缓存教师模型每位置的 top-100 logits,使教师无需与学生同时驻留显存;融合分块 KL 损失避免生成完整的词表×序列长度矩阵。以 gpt-oss-120b 为例,稠密 KL 峰值约 250GB,超过单张 H200 的 141GB,融合分块方案峰值约 128GB,使长上下文修复可在单 GPU 上完成。
OpenAI 推出网络安全专用模型 GPT-5.6-Cyber,通过 Daybreak Red 提供,用于授权漏洞研究、漏洞利用验证和安全测试。此举是 OpenAI 扩展 Daybreak 计划的一部分,背景是网络防御窗口正在收窄。
OpenAI 允许获批的 Daybreak 合作伙伴使用其前沿网络安全模型,向客户提供经授权、受治理的网络安全服务。
Meta 发布 Muse Glimmer,一个从 Muse 蒸馏到 30B 参数的多模态模型,采用 Apache 2.0 许可,面向本地智能体场景,可用于编码、文档分析和个人助手等隐私敏感应用。
推荐理由:Meta 开源 30B 多模态模型并给出本地智能体场景的基准对比,可据此判断本地部署的可行性。
Zapier 企业营销团队使用 ChatGPT Work 减少线索漏斗流失、制作营销活动素材并自动化报告。