最新精选 第 121–140 条 · 共 165 条 23:11 Google DeepMind 精选AI 评分 80 80 Google DeepMind 发布 Nano Banana Pro(Gemini 3 Pro Image),基于 Gemini 3 Pro 构建,面向开发者提供影棚级图像生成与编辑,已在 Google AI Studio 和 Vertex AI 以付费预览形式逐步开放。
推荐理由:官方给出新图像模型的分辨率、文本渲染与搜索接地能力,以及 Adobe、Figma 等接入情况,便于判断其与上一代的取舍。
01:49 Google DeepMind 精选AI 评分 87 87 Google DeepMind 发布 Gemini 3 Pro,称其在主要 AI 基准上超过此前版本,编码与智能体任务表现优于 2.5 Pro。模型已在 Google AI Studio 和 Vertex AI 以预览形式开放,200k token 以内输入 $2/百万 token、输出 $12/百万 token,并在 Google AI Studio 免费提供但有限速。
推荐理由:官方给出 Gemini 3 Pro 的基准成绩、API 定价与 Antigravity 平台入口,可据此判断其编码与智能体能力落点。
00:06 Google DeepMind 精选AI 评分 87 87 Google DeepMind 发布 Gemini 3,称其为自家最智能的模型,首发 Gemini 3 Pro 预览版,并同步上线 Gemini 应用、Search 的 AI Mode、AI Studio、Vertex AI、Gemini CLI 及新的智能体开发平台 Google Antigravity。
推荐理由:官方一次性给出 Gemini 3 Pro 与 Deep Think 的基准成绩、产品落地范围和开放入口,可据此判断能力代际变化。
00:06 Google DeepMind 精选AI 评分 82 82 Google 发布智能体开发平台 Antigravity,已开放免费公开预览,支持 macOS、Linux 和 Windows。该平台在传统 AI IDE 的 Editor 视图之外新增面向智能体的 Manager 视图,可并行编排多个工作区中的智能体,并通过任务列表、实现计划、截图和浏览器录制等 Artifacts 呈现工作过程。
推荐理由:Google 把 IDE 拆成同步编辑器与异步 Agent Manager 两层,读者可据此判断智能体编程工具的产品形态走向。
00:00 Google Research 精选AI 评分 82 82 Google 推出生成式 UI 实现,由模型按提示词自动生成网页、游戏、工具等交互界面,而非渲染静态预设界面。该能力以 dynamic view 和 visual layout 两个实验在 Gemini app 上线,并集成到 Google Search 的 AI Mode,基于 Gemini 3 Pro 与工具调用、系统指令、后处理三部分实现。
推荐理由:Google 把生成式 UI 落到 Gemini 与搜索 AI Mode,读者可了解其实现路径与人工评测偏好结果。
22:52 Google DeepMind 精选AI 评分 66 66 Google DeepMind 发布 SIMA 2,将 Gemini 模型嵌入智能体核心,使其从指令跟随者升级为能思考目标、与用户对话并随时间自我改进的交互式游戏伙伴。
推荐理由:SIMA 2 把 Gemini 的推理能力接入 3D 游戏智能体,读者可了解从指令跟随到自主推理与自我改进的路径。
06:36 Google Research 精选AI 评分 60 60 Google 公布个人健康教练的构建细节,该功能由 Gemini 模型驱动,面向美国 Fitbit Premium 的 Android 用户开放可选公开预览,并将扩展到 iOS。
推荐理由:Google 公开了健康教练的多智能体架构与 SHARP 评估框架,可了解 Gemini 在健康场景的落地方式。
20:00 Mistral AI 发布企业级生产平台 Mistral AI Studio,由 Observability、Agent Runtime 和 AI Registry 三大支柱组成,覆盖评估、反馈闭环、版本溯源与治理。
推荐理由:Mistral 把自家大规模系统的可观测、执行与治理能力打包成企业平台,可了解生产级 AI 的落地路径。
08:00 Hugging Face Blog 精选AI 评分 66 66 Meta 与 Hugging Face 合作推出 OpenEnv Hub,一个面向智能体环境的开放共享社区平台,环境可用于训练和部署。下周起开发者可在 Hugging Face 上访问该 Hub,以人类智能体身份直接与环境交互、让模型在环境中解题,并查看环境暴露的工具和观测定义;符合 OpenEnv 规范的环境上传后自动获得这些功能。
推荐理由:Meta 与 Hugging Face 联合推出智能体环境共享 Hub,并公开 0.1 规范草案,读者可据此了解智能体训练与部署环境的标准化路径。
18:50 OpenAI Codex 现已正式可用(generally available),并面向开发者推出多项新功能:Slack 集成、Codex SDK,以及用量仪表盘和工作区管理等管理工具。官方称这些更新让 Codex 更易使用,也便于在规模化场景下管理。
推荐理由:OpenAI 官方给出 Codex 正式版新增的 Slack 集成、SDK 与管理工具,可据此判断团队规模化使用的接入方式。
18:00 OpenAI 在 ChatGPT 内引入新一代可直接对话的应用,开发者即日起可用新的 Apps SDK 开始构建,该 SDK 目前处于预览阶段。
推荐理由:OpenAI 官方给出 ChatGPT 内嵌应用与 Apps SDK 预览入口,可据此判断第三方应用接入 ChatGPT 的方式。
08:00 OpenAI 发布 AgentKit、扩展后的 Evals 能力以及面向智能体的强化微调(RFT),称这些新工具用于帮助开发者更快从原型走向生产。官方表示这三项能力面向智能体开发场景,但未在摘要中给出具体功能细节与开放方式。
推荐理由:OpenAI 官方一次性放出 AgentKit、Evals 扩展与面向智能体的强化微调,可据此了解其智能体开发工具链的补齐方向。
08:00 Hugging Face Blog 精选AI 评分 66 66 Hugging Face 发布 GAIA 的后继智能体基准 Gaia2,并开源配套的 Meta Agents Research Environments(ARE)框架,用于运行、调试和评测智能体。
推荐理由:GAIA 后继基准 Gaia2 转向读写与噪声环境,配套 ARE 框架可复现评测,便于对照各家模型在真实任务上的差距。
08:00 OpenAI 发布 GPT-5 系统卡附录,公开新模型 GPT-5-Codex,这是 GPT-5 针对 Codex 中智能体编码进一步优化的版本。该模型会根据任务复杂度更动态地调整思考投入,对简单对话查询或小任务快速响应,对更复杂的任务则独立工作更长时间。
推荐理由:官方系统卡附录披露 GPT-5-Codex 按任务复杂度动态调整思考投入,可据此了解 Codex 中编码智能体的能力取向。
12:00 Mistral 在 Le Chat 中发布 20 多个基于 MCP 的安全连接器目录(beta),覆盖数据、生产力、开发、自动化与商务等类别,支持接入 Databricks、Snowflake、GitHub、Atlassian、Asana、Outlook、Box、Stripe、Zapier 等工具,并允许添加自定义 MCP 连接器或连接任意远程 MCP 服务器。
推荐理由:官方给出连接器目录、自定义 MCP 与记忆功能的开放范围,读者可据此判断企业工作流接入方式。
20:00 Mistral AI 发布 Codestral 25.08,并推出面向企业的完整编码栈,包含 Codestral、Codestral Embed、Devstral 与 Mistral Code IDE 插件。
推荐理由:Mistral 官方给出企业级编码栈的完整组成与自部署路径,可据此判断私有化编码助手的落地条件。
20:00 Mistral 为 Le Chat 上线一批新功能,包括预览版 Deep Research 模式、由新语音模型 Voxtral 驱动的语音模式、由推理模型 Magistral 支持的多语言推理、用于整理对话的 Projects,以及与 Black Forest Labs 合作的高级图像编辑。
推荐理由:Mistral 一次性为 Le Chat 补齐深度研究、语音、推理与图像编辑能力,可据此判断其产品线走向。
18:00 OpenAI 推出 ChatGPT agent,官方称它能思考并行动,调用工具完成研究、预订和制作幻灯片等任务,全程由用户引导。
推荐理由:OpenAI 官方给出 ChatGPT agent 的定位与任务范围,可据此判断它在研究、预订等场景中的使用方式。
18:00 OpenAI 发布 ChatGPT agent 系统卡,介绍这一智能体模型整合了研究、浏览器自动化和代码工具。系统卡说明相关能力在 Preparedness Framework 下配有安全防护措施。
推荐理由:OpenAI 官方系统卡披露 ChatGPT agent 的能力组合与 Preparedness Framework 下的安全措施,可了解其风险边界设定。
00:00 Mistral AI 与 All Hands AI 合作推出 Devstral Medium,并升级 Devstral Small 至 1.1 版本。
推荐理由:Mistral 与 All Hands AI 联合发布两款编码智能体模型,给出了 SWE-Bench Verified 分数、开源许可与 API 定价,便于读者比较开源与闭源方案的成本性能。
上一页 1 … 5 6 7 8 9 下一页