跳到正文

Agent 智能体

让模型自主规划、调用工具、完成多步任务的技术方向——从 Claude Code、Manus 到各家 Agent 框架与评测基准的全部动态。

最新精选

第 121–140 条 · 共 165 条
11月20日周四
  1. Google DeepMind80

    Google DeepMind 发布 Nano Banana Pro(Gemini 3 Pro Image)图像模型

    Google DeepMind 发布 Nano Banana Pro(Gemini 3 Pro Image),基于 Gemini 3 Pro 构建,面向开发者提供影棚级图像生成与编辑,已在 Google AI Studio 和 Vertex AI 以付费预览形式逐步开放。

    推荐理由:官方给出新图像模型的分辨率、文本渲染与搜索接地能力,以及 Adobe、Figma 等接入情况,便于判断其与上一代的取舍。

11月19日周三
  1. Google DeepMind87

    Google DeepMind 发布 Gemini 3 Pro 并推出 Antigravity 开发平台

    Google DeepMind 发布 Gemini 3 Pro,称其在主要 AI 基准上超过此前版本,编码与智能体任务表现优于 2.5 Pro。模型已在 Google AI Studio 和 Vertex AI 以预览形式开放,200k token 以内输入 $2/百万 token、输出 $12/百万 token,并在 Google AI Studio 免费提供但有限速。

    推荐理由:官方给出 Gemini 3 Pro 的基准成绩、API 定价与 Antigravity 平台入口,可据此判断其编码与智能体能力落点。

  2. Google DeepMind87

    Google DeepMind 发布 Gemini 3,Pro 版预览上线并推出 Deep Think 模式

    Google DeepMind 发布 Gemini 3,称其为自家最智能的模型,首发 Gemini 3 Pro 预览版,并同步上线 Gemini 应用、Search 的 AI Mode、AI Studio、Vertex AI、Gemini CLI 及新的智能体开发平台 Google Antigravity。

    推荐理由:官方一次性给出 Gemini 3 Pro 与 Deep Think 的基准成绩、产品落地范围和开放入口,可据此判断能力代际变化。

  3. Google DeepMind82

    Google 发布智能体开发平台 Antigravity

    Google 发布智能体开发平台 Antigravity,已开放免费公开预览,支持 macOS、Linux 和 Windows。该平台在传统 AI IDE 的 Editor 视图之外新增面向智能体的 Manager 视图,可并行编排多个工作区中的智能体,并通过任务列表、实现计划、截图和浏览器录制等 Artifacts 呈现工作过程。

    推荐理由:Google 把 IDE 拆成同步编辑器与异步 Agent Manager 两层,读者可据此判断智能体编程工具的产品形态走向。

  4. Google Research82

    Google 推出生成式 UI,在 Gemini 与搜索 AI Mode 中上线实验

    Google 推出生成式 UI 实现,由模型按提示词自动生成网页、游戏、工具等交互界面,而非渲染静态预设界面。该能力以 dynamic view 和 visual layout 两个实验在 Gemini app 上线,并集成到 Google Search 的 AI Mode,基于 Gemini 3 Pro 与工具调用、系统指令、后处理三部分实现。

    推荐理由:Google 把生成式 UI 落到 Gemini 与搜索 AI Mode,读者可了解其实现路径与人工评测偏好结果。

11月13日周四
  1. Google DeepMind66

    Google DeepMind 发布 SIMA 2:可推理、对话并在 3D 虚拟世界中自我改进的智能体

    Google DeepMind 发布 SIMA 2,将 Gemini 模型嵌入智能体核心,使其从指令跟随者升级为能思考目标、与用户对话并随时间自我改进的交互式游戏伙伴。

    推荐理由:SIMA 2 把 Gemini 的推理能力接入 3D 游戏智能体,读者可了解从指令跟随到自主推理与自我改进的路径。

10月28日周二
10月24日周五
  1. Mistral AI60

    Mistral AI 发布 AI Studio 生产平台

    Mistral AI 发布企业级生产平台 Mistral AI Studio,由 Observability、Agent Runtime 和 AI Registry 三大支柱组成,覆盖评估、反馈闭环、版本溯源与治理。

    推荐理由:Mistral 把自家大规模系统的可观测、执行与治理能力打包成企业平台,可了解生产级 AI 的落地路径。

10月23日周四
  1. Hugging Face Blog66

    Meta 与 Hugging Face 联合推出 OpenEnv Hub,发布 OpenEnv 0.1 规范草案

    Meta 与 Hugging Face 合作推出 OpenEnv Hub,一个面向智能体环境的开放共享社区平台,环境可用于训练和部署。下周起开发者可在 Hugging Face 上访问该 Hub,以人类智能体身份直接与环境交互、让模型在环境中解题,并查看环境暴露的工具和观测定义;符合 OpenEnv 规范的环境上传后自动获得这些功能。

    推荐理由:Meta 与 Hugging Face 联合推出智能体环境共享 Hub,并公开 0.1 规范草案,读者可据此了解智能体训练与部署环境的标准化路径。

10月6日周一
  1. OpenAI News70

    OpenAI Codex 正式可用,新增 Slack 集成、SDK 与管理工具

    OpenAI Codex 现已正式可用(generally available),并面向开发者推出多项新功能:Slack 集成、Codex SDK,以及用量仪表盘和工作区管理等管理工具。官方称这些更新让 Codex 更易使用,也便于在规模化场景下管理。

    推荐理由:OpenAI 官方给出 Codex 正式版新增的 Slack 集成、SDK 与管理工具,可据此判断团队规模化使用的接入方式。

  2. OpenAI News62

    OpenAI 发布 AgentKit、新版 Evals 与面向智能体的 RFT

    OpenAI 发布 AgentKit、扩展后的 Evals 能力以及面向智能体的强化微调(RFT),称这些新工具用于帮助开发者更快从原型走向生产。官方表示这三项能力面向智能体开发场景,但未在摘要中给出具体功能细节与开放方式。

    推荐理由:OpenAI 官方一次性放出 AgentKit、Evals 扩展与面向智能体的强化微调,可据此了解其智能体开发工具链的补齐方向。

9月22日周一
9月15日周一
  1. OpenAI News66

    OpenAI 发布 GPT-5-Codex,为 Codex 中的智能体编码优化

    OpenAI 发布 GPT-5 系统卡附录,公开新模型 GPT-5-Codex,这是 GPT-5 针对 Codex 中智能体编码进一步优化的版本。该模型会根据任务复杂度更动态地调整思考投入,对简单对话查询或小任务快速响应,对更复杂的任务则独立工作更长时间。

    推荐理由:官方系统卡附录披露 GPT-5-Codex 按任务复杂度动态调整思考投入,可据此了解 Codex 中编码智能体的能力取向。

9月2日周二
  1. Mistral AI62

    Mistral 为 Le Chat 上线自定义 MCP 连接器与 Memories 记忆功能

    Mistral 在 Le Chat 中发布 20 多个基于 MCP 的安全连接器目录(beta),覆盖数据、生产力、开发、自动化与商务等类别,支持接入 Databricks、Snowflake、GitHub、Atlassian、Asana、Outlook、Box、Stripe、Zapier 等工具,并允许添加自定义 MCP 连接器或连接任意远程 MCP 服务器。

    推荐理由:官方给出连接器目录、自定义 MCP 与记忆功能的开放范围,读者可据此判断企业工作流接入方式。

7月30日周三
7月17日周四
  1. Mistral AI66

    Mistral 为 Le Chat 推出 Deep Research、语音模式等多项新功能

    Mistral 为 Le Chat 上线一批新功能,包括预览版 Deep Research 模式、由新语音模型 Voxtral 驱动的语音模式、由推理模型 Magistral 支持的多语言推理、用于整理对话的 Projects,以及与 Black Forest Labs 合作的高级图像编辑。

    推荐理由:Mistral 一次性为 Le Chat 补齐深度研究、语音、推理与图像编辑能力,可据此判断其产品线走向。

  2. OpenAI News75

    OpenAI 推出 ChatGPT agent

    OpenAI 推出 ChatGPT agent,官方称它能思考并行动,调用工具完成研究、预订和制作幻灯片等任务,全程由用户引导。

    推荐理由:OpenAI 官方给出 ChatGPT agent 的定位与任务范围,可据此判断它在研究、预订等场景中的使用方式。

  3. OpenAI News62

    OpenAI 发布 ChatGPT agent 系统卡

    OpenAI 发布 ChatGPT agent 系统卡,介绍这一智能体模型整合了研究、浏览器自动化和代码工具。系统卡说明相关能力在 Preparedness Framework 下配有安全防护措施。

    推荐理由:OpenAI 官方系统卡披露 ChatGPT agent 的能力组合与 Preparedness Framework 下的安全措施,可了解其风险边界设定。

7月11日周五