跳到正文

全部动态

今日 61 条
12月16日周二
  1. Google Research60

    Google 为 STOC 2026 推出 Gemini 驱动的 Paper Assistant Tool 论文反馈工具

    Google Research 为 STOC 2026 推出实验性 Paper Assistant Tool(PAT),基于 Gemini 2.5 Deep Think 的推理扩展方法,在投稿后 24 小时内为作者生成结构化预审反馈,涵盖论文贡献摘要、潜在错误与改进建议以及笔误清单。

    推荐理由:Google 官方披露 PAT 在 STOC 2026 的实测数据与作者反馈,可了解 AI 辅助数学证明审阅的实际边界。

12月13日周六
12月12日周五
12月11日周四
  1. Hugging Face Blog62

    llama.cpp server 新增 router 模式,支持动态加载与切换多个模型

    llama.cpp server 新增 router 模式,无需重启即可动态加载、卸载和切换多个模型,实现类似 Ollama 的模型管理。该模式采用多进程架构,每个模型独立运行,单个模型崩溃不影响其他模型;模型按需加载,超过 --models-max(默认 4)时按 LRU 策略卸载最久未用的模型。

    推荐理由:llama.cpp server 新增 router 模式,读者可据此了解本地多模型热切换与显存回收的具体做法。

  2. OpenAI News80

    OpenAI 发布 GPT-5.2,面向科学与数学能力升级

    OpenAI 发布 GPT-5.2,称其为该公司在数学与科学方面最强的模型,在 GPQA Diamond 和 FrontierMath 等基准上刷新 SOTA。官方表示这些提升已转化为实际研究进展,包括解决一个开放理论问题并生成可靠的数学证明。

    推荐理由:OpenAI 官方给出 GPT-5.2 在数学与科学基准上的新 SOTA 结果,并说明其已用于解决一个开放理论问题。

  3. Google DeepMind24

    Google DeepMind 扩大与英国 AI Security Institute 的合作,聚焦基础安全研究

    Google DeepMind 宣布与英国 AI Security Institute(AISI)签署新谅解备忘录,将合作从模型测试扩展到基础安全与安全研究。双方将共享专有模型、数据与思路,并联合发布报告,重点研究 CoT 监控、社会情感错位影响以及 AI 对经济系统的冲击。Google DeepMind 称 Gemini 3 是其迄今最智能、最安全的模型。

  4. OpenAI News66

    OpenAI 更新 GPT-5 系统卡,纳入 GPT-5.2

    OpenAI 更新 GPT-5 系统卡,将 GPT-5.2 纳入其中。GPT-5.2 是 GPT-5 系列的最新模型家族,其安全缓解方案与 GPT-5 系统卡、GPT-5.1 系统卡所述基本一致。这些模型与 OpenAI 其他模型一样,训练数据包括互联网公开信息、通过第三方合作获取的信息,以及用户或人类训练师与研究人员提供或生成的信息。

    推荐理由:官方系统卡更新披露 GPT-5.2 的安全缓解思路与 GPT-5 系列保持一致,可对照前代系统卡了解其安全策略延续性。

  5. OpenAI News80

    OpenAI 发布 GPT-5.2 前沿模型

    OpenAI 发布 GPT-5.2,定位为面向日常专业工作的前沿模型,具备领先的推理、长上下文理解、编码和视觉能力。该模型已在 ChatGPT 和 OpenAI API 中提供,用于支持更快、更可靠的智能体工作流。

    推荐理由:官方给出 GPT-5.2 在推理、长上下文、编码与视觉上的定位,可据此判断日常专业工作与智能体流程的可用性。

  6. OpenAI News60

    迪士尼与 OpenAI 达成协议,200 多个角色接入 Sora

    迪士尼与 OpenAI 达成协议,将 200 多个迪士尼、Marvel、Pixar 和 Star Wars 角色引入 Sora,用于粉丝创作的短视频。协议强调娱乐领域的负责任 AI,同时包含迪士尼在全公司范围使用 ChatGPT Enterprise 和 OpenAI API。

    推荐理由:迪士尼与 OpenAI 的授权协议把 200 多个 IP 角色接入 Sora,并附带企业级 ChatGPT 采购,可观察内容版权与生成式视频的合作模式。

  7. Google Research31

    Google 提出 Urania:用差分隐私从 AI 聊天机器人对话中挖掘使用洞察

    Google Research 在 COLM 2025 论文中提出 Urania 框架,通过差分隐私(DP)聚类与 DP 关键词提取,从 LLM 聊天机器人对话中生成使用洞察,且 LLM 只接触匿名关键词、不接触原始对话。与基于 CLIO 的非隐私基线 Simple-CLIO 相比,其隐私摘要在人工评估中最高有 70% 的情况更受 LLM 评审青睐,但隐私预算收紧时主题覆盖度会下降。

12月10日周三
12月9日周二
  1. Mistral AI80

    Mistral 发布 Devstral 2 编码模型与 Mistral Vibe CLI

    Mistral AI 发布新一代编码模型系列 Devstral 2,含 123B 的 Devstral 2 和 24B 的 Devstral Small 2,分别采用修改版 MIT 和 Apache 2.0 许可,均为开源。

    推荐理由:官方给出两款开源编码模型的参数、许可与 SWE-bench 成绩,并附与闭源模型的对比评测,可据此判断开源编码智能体的当前水位。

12月8日周一
12月5日周五
  1. Hugging Face Blog40

    Hugging Face 发布 swift-huggingface:完整的 Swift 客户端

    Hugging Face 推出 swift-huggingface,一个面向 Hub 的完整 Swift 客户端包,可独立使用,后续将并入 swift-transformers 替换现有 HubApi。它提供完整 Hub API 覆盖、断点续传与进度追踪、与 Python 兼容的共享缓存,以及 TokenProvider 认证和 OAuth 2.0 支持,基于分块去重的 Xet 存储后端即将上线。

  2. Google DeepMind39

    科学家用 AlphaFold 改造光合作用关键酶,培育耐热作物

    密歇根州立大学 Berkley Walker 团队借助 AlphaFold 预测植物与嗜热藻类的甘油酸激酶(GLYK)三维结构,发现植物版 GLYK 的三个柔性环在高温下变形失稳。他们将藻类 GLYK 中更刚性的环替换进植物酶,构建的杂合酶中有一个在高达 65 °C 下仍保持稳定,为培育耐热作物提供了路径。

12月4日周四