跳到正文

全部动态

今日 12 条
3月5日周四
2月27日周五
2月26日周四
2月19日周四
  1. Google DeepMind71

    Gemini 上线 Lyria 3 音乐生成,支持文字与图片生成 30 秒曲目

    Google DeepMind 的最新生成式音乐模型 Lyria 3 以 beta 形式在 Gemini app 上线,用户用文字或上传图片、视频即可生成 30 秒带歌词或纯器乐的曲目,并附由 Nano Banana 生成的封面图。

    推荐理由:官方披露 Lyria 3 在 Gemini 中的生成方式、语言覆盖与 SynthID 音频验证,可据此判断音乐生成的实际可用边界。

2月13日周五
  1. OpenAI News60

    OpenAI 在 ChatGPT 中推出 Lockdown Mode 与 Elevated Risk 标签

    OpenAI 在 ChatGPT 中推出 Lockdown Mode 和 Elevated Risk 标签,帮助组织防御提示词注入和 AI 驱动的数据外泄。官方仅给出这两项功能的名称与防护目标,未披露具体机制和可用范围。

    推荐理由:OpenAI 在 ChatGPT 中新增面向组织的提示词注入与数据外泄防护选项,可了解其安全边界思路。

2月9日周一
2月6日周五
2月5日周四
  1. Google Research36

    Google 如何用 AI 工具重新定义通用设计以提升无障碍体验

    Google 提出 Natively Adaptive Interfaces(NAI)框架,用多模态 AI 工具让 UI 从静态导航转向智能体驱动的动态模块,以缩小新功能发布与辅助层之间的"无障碍鸿沟"。原型包括面向盲人与低视力用户的 StreetReaderAI,以及基于 Gemini 模型、可实时调整描述细节的 Multimodal Agent Video Player(MAVP)。

2月4日周三
  1. Hugging Face Blog62

    Hugging Face 推出 Community Evals,让基准数据集托管排行榜

    Hugging Face 推出 Community Evals,基准数据集仓库现在可以注册为 benchmark 并托管排行榜,模型仓库通过 .eval_results/*.yaml 存储自己的评测分数,任何用户都能以 PR 形式提交结果。

    推荐理由:Hugging Face 把评测结果从黑箱榜单搬到 Hub 仓库,读者可据此理解社区化评测的运作方式。

2月3日周二
2月2日周一
  1. OpenAI News62

    OpenAI 发布 macOS 版 Codex 应用

    OpenAI 发布面向 macOS 的 Codex 应用,定位为 AI 编码与软件开发的指挥中心,支持多智能体、并行工作流和长时间运行的任务。

    推荐理由:OpenAI 官方给出 Codex 桌面端的产品定位与多智能体并行能力,可据此判断 AI 编码入口的形态变化。

1月30日周五
  1. Google DeepMind71

    Google DeepMind 向美国 AI Ultra 订阅者开放 Project Genie 世界模型原型

    Google DeepMind 开始向美国 18 岁以上的 Google AI Ultra 订阅者开放 Project Genie,这是一个由 Genie 3、Nano Banana Pro 和 Gemini 驱动的实验性研究原型,支持创建、探索和混编交互式世界。

    推荐理由:官方披露了世界模型原型的三项核心能力与已知限制,可据此判断实时生成交互世界的可用边界。

1月29日周四
  1. Hugging Face Blog62

    Gradio 团队开源 Daggr:用 Python 串联应用并可视化检查

    Gradio 团队发布开源 Python 库 Daggr,用于把 Gradio 应用、ML 模型和自定义函数串成 AI 工作流,并自动生成可视化画布。画布可查看任意节点的中间输出、修改输入并单独重跑某一步,无需执行整条流水线,还支持状态持久化和备份节点替换。

    推荐理由:Gradio 团队开源 Daggr,用代码定义工作流并自动生成可视化画布,可单独重跑某一步,为多模型串联调试提供了新选择。

1月28日周三
  1. Mistral AI62

    Mistral 发布终端编码智能体 Mistral Vibe 2.0

    Mistral 发布终端编码智能体 Mistral Vibe 2.0,由 Devstral 2 模型系列驱动,新增自定义子智能体、多选项澄清、斜杠命令技能和统一智能体模式,CLI 修复持续自动更新。

    推荐理由:官方给出 Vibe 2.0 的自定义子智能体、斜杠命令技能与定价变化,可据此判断终端编码智能体的使用成本。

1月27日周二
1月22日周四
1月21日周三
1月20日周二
1月16日周五
  1. OpenAI News62

    OpenAI 面向全球推出 ChatGPT Go

    OpenAI 宣布 ChatGPT Go 已在全球上线,提供 GPT-5.2 Instant 的扩展访问、更高的使用额度和更长的记忆能力。官方称该档位让先进 AI 在全球范围内更可负担。

    推荐理由:官方给出 ChatGPT Go 的全球开放范围与三项能力变化,可据此判断低价档位的实际可用边界。

1月15日周四
1月14日周三
  1. Google DeepMind71

    Google DeepMind 更新 Veo 3.1 Ingredients to Video,支持原生竖屏与 1080p/4K 放大

    Google DeepMind 更新 Veo 3.1 的 Ingredients to Video 能力,让基于参考图生成的视频在简单提示词下也有更丰富的对白与叙事,并提升角色、背景和物体的一致性。

    推荐理由:官方说明了 Ingredients to Video 在角色一致性与竖屏输出上的具体变化,可据此判断移动端短视频工作流是否值得切换。

1月9日周五
1月8日周四
1月7日周三
  1. OpenAI News62

    OpenAI 推出 ChatGPT Health

    OpenAI 推出 ChatGPT Health,这是一个可安全连接个人健康数据与应用的独立体验。官方称其具备隐私保护措施,并采用由医生参与设计的方案。

    推荐理由:OpenAI 官方给出 ChatGPT Health 的定位与隐私设计,读者可据此判断健康数据接入的边界。

12月18日周四
12月17日周三
  1. OpenAI News62

    OpenAI 开放 ChatGPT 应用提交,开发者可申请上架

    OpenAI 宣布开发者可以向 ChatGPT 提交应用,经审核通过后会在产品内的新应用目录中展示。官方同时更新了工具、指南和 Apps SDK,用于构建把真实操作带入 ChatGPT 的对话原生体验。

    推荐理由:OpenAI 开放 ChatGPT 应用提交入口并给出 Apps SDK 与审核规范,开发者可据此判断接入路径。

12月16日周二
  1. Google Research60

    Google 为 STOC 2026 推出 Gemini 驱动的 Paper Assistant Tool 论文反馈工具

    Google Research 为 STOC 2026 推出实验性 Paper Assistant Tool(PAT),基于 Gemini 2.5 Deep Think 的推理扩展方法,在投稿后 24 小时内为作者生成结构化预审反馈,涵盖论文贡献摘要、潜在错误与改进建议以及笔误清单。

    推荐理由:Google 官方披露 PAT 在 STOC 2026 的实测数据与作者反馈,可了解 AI 辅助数学证明审阅的实际边界。

12月12日周五
12月11日周四
  1. Hugging Face Blog62

    llama.cpp server 新增 router 模式,支持动态加载与切换多个模型

    llama.cpp server 新增 router 模式,无需重启即可动态加载、卸载和切换多个模型,实现类似 Ollama 的模型管理。该模式采用多进程架构,每个模型独立运行,单个模型崩溃不影响其他模型;模型按需加载,超过 --models-max(默认 4)时按 LRU 策略卸载最久未用的模型。

    推荐理由:llama.cpp server 新增 router 模式,读者可据此了解本地多模型热切换与显存回收的具体做法。