跳到正文

全部动态

今日 56 条
10月2日周五
  1. BestBlogs.dev82

    谷歌发布 Gemini 4 系列首款旗舰模型 Argon

    谷歌于 9 月 30 日发布 Gemini 4 系列首款旗舰模型 Argon,在软件工程、金融研究、法律研究及企业自动化等领域评测中表现领先。Argon 支持最高 100 万单次词元输出,高于此前的 6.4 万,缓存输入价格较前版本降低 95%,并能自主发现、验证并修复软件漏洞,目前已向部分合作方开放。随着 Argon 落地,谷歌取消了原定于 6 月发布的 Gemini 3.5 Pro 迭代计划。

    推荐理由:谷歌 Gemini 4 系列首款旗舰模型 Argon 的能力与定价变化,以及随之取消的 Gemini 3.5 Pro 迭代计划。

  2. BestBlogs.dev22

    美债收益率高企施压,KBW 银行指数创四个月新低,花旗盘中跌近 5%

    受美债收益率持续攀升影响,美国银行股深陷调整,KBW 银行指数创四个月新低,较 8 月中旬高点回落 14%,花旗集团盘中一度跌近 5%。分析师认为市场对 AI 智能体威胁、美国中选影响及利率上升的担忧可能已过度,9 月金融板块相对其他行业表现为 1990 年以来同期最差。10 月 13 日大行财报季开启,银行盈利表现将成为验证市场走势的关键。

  3. BestBlogs.dev75

    Anthropic 被曝冲刺感恩节前 IPO,目标估值最高 2 万亿美元

    据彭博社等知情人士消息,Anthropic 计划于 11 月月中启动正式营销,争取在 11 月 26 日感恩节前完成 IPO,潜在投资者对其合理估值的预期在 1.8 万亿至 2 万亿美元之间。报道称其最快可能在 11 月 9 日当周启动路演,此前进度曾有所推迟,公司仍目标年底登陆公开市场。在美国新股市场整体表现低迷的背景下,此次上市被视为观察 AI 巨头高估值能否从私募市场传导至公开市场的窗口。

  4. AWS Machine Learning Blog30

    Amazon Payments 如何用 Amazon SageMaker AI 上的上下文多臂老虎机提升获客漏斗转化率

    Amazon Payments 在 Amazon SageMaker AI 上用多目标上下文多臂老虎机(LinUCB)优化产品获客漏斗,七周线上 A/B 测试中,一个人群的最终漏斗转化率取得高个位数相对提升,另一个人群则未见改善。团队按申请开始、提交、审批三个阶段各跑一个 LinUCB 模型并线性组合其 UCB 分数,以缓解单阶段优化带来的跷跷板问题,同时开源了可在合成数据上验证该方法的代码仓库。

  5. BestBlogs.dev34

    美国 9 月裁员人数创四年同期新低,招聘意愿降至十五年低谷

    美国 9 月企业裁员人数同比下降近 20% 至 4.3281 万人,创四年同期新低,但科技企业裁员人数环比激增 77%。当月企业意向招聘人数同比下降 23%,创十五年同期低位,上周首次申请失业救济人数降至 19.7 万。全年来看,AI 已成为裁员被援引最多的原因,占全部计划裁员的约 21%。

  6. BestBlogs.dev32

    世界-动作模型(WAM)综述:从预测未来到机器人闭环控制

    一篇综述系统梳理了机器人领域的世界-动作模型(WAM),其核心是将未来状态预测与可执行动作生成连接起来,让预测服务于真实控制。综述将现有研究归纳为基于世界模型的强化学习、视频生成、潜在动作预训练和 VLA 模型四条路线,并覆盖机器人操作、导航、自动驾驶等应用及未来挑战。

10月1日周四
  1. BestBlogs.dev62

    华为与赛力斯签署五年战略合作,问界业务改由赛力斯主导

    华为与赛力斯于 9 月 30 日正式签署五年战略合作协议,终结此前持续 15 天的“分手”传闻。新模式下,问界的产品定义、设计、品牌营销、渠道零售及服务体系由赛力斯主导,华为转向技术支持与生态赋能,并将资源更多投入尊界、享界、智界等品牌。问界仍是鸿蒙智行核心高端品牌,2026 年内上市的新款车型仍由华为团队深度参与。

  2. BestBlogs.dev80

    谷歌发布 Gemini 4 Argon:多项基准登顶,首批仅限审核团队

    谷歌发布新一代旗舰模型 Gemini 4 Argon,在 DeepSWE v1.1(77.9%)、CWE-bench v1(68%)、Vals Index(68.90%)和 Text Arena(1525 分)等评测中领跑,但在 Code Arena 仅排第八。

    推荐理由:汇总了 Gemini 4 Argon 的多项基准成绩、定价与首批开放范围,并附上内部员工对跑分与实际编程表现的争议。

  3. NVIDIA Blog22

    NVIDIA AI 工厂如何实现高投资回报:高产出、长寿命、通用性

    NVIDIA 提出 AI 工厂投资回报取决于三个因素:每兆瓦产出能力、硬件使用寿命和 token 需求,其平台以高吞吐、长服役周期和通用性同时优化这三项。SemiAnalysis AgentX 数据显示,Vera Rubin NVL72 每兆瓦吞吐量比 GB300 NVL72 高 30 倍以上,在 DeepSeek V4 Pro 上每百万 token 成本最多低 45 倍。

  4. BestBlogs.dev28

    企业真正用上 AI 后,安全该怎么测?AccessB 研讨会回顾

    AccessB 线上研讨会指出,企业将大模型和 Agent 接入业务后,安全风险已从"模型回答错误"扩展到敏感数据泄露、Prompt 注入、第三方 API 风险及 Agent 工具调用越界。传统 Web 安全测试难以发现多轮交互中的行为偏移和权限访问问题,建议企业从高风险业务场景入手,对模型、数据、权限及执行链路做深度测试,逐步构建 AI 安全评测体系。

  5. Latent Space82

    Google DeepMind 发布 Gemini 4 Argon,支持 1M 输出 token

    Google DeepMind 发布 Gemini 4 Argon,面向编码、企业知识工作和网络防御,先在 Fairwind 计划的政府用户与可信网络防御者中开放,后续再向开发者、企业和消费者开放。

    推荐理由:汇总 Gemini 4 Argon 的基准、定价与第三方评测分歧,可对照其与 Astra、Opus 5.5 的能力与成本差异。

  6. Google DeepMind80

    Google DeepMind 发布 Gemini 4 Argon 前沿模型

    Google DeepMind 发布新前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向受信任的网络安全防御方开放,随后逐步扩展至开发者、企业和消费者。

    推荐理由:官方给出 Argon 在编码、企业知识与网络安全防御上的基准表现和分阶段开放路径,可据此判断前沿模型的能力边界与落地节奏。

  7. Ars Technica · AI58

    Google 向约 100 家网站支付 AI 内容分成,金额仅约广告收入千分之一

    Google 的 AI 贡献试点已接纳约 100 家网站,当网站内容对 Gemini 驱动的 AI Overview 等搜索结果有实质贡献时可获得付款。据 The Information 报道,参与试点的小型和中型网站反映 Google 的 AI 付款极少,约相当于其广告收入的千分之一,部分大型网站已拒绝参与,希望借此迫使 Google 给出更慷慨的条件。

9月30日周三
  1. AWS Machine Learning Blog62

    在 Amazon Bedrock AgentCore Runtime Instances 上构建多智能体音乐制作流水线

    AWS 官方博客介绍如何在 Amazon Bedrock AgentCore Runtime Instances 上部署三智能体音乐制作流水线,由作曲、交付、合规三个智能体在同一 GPU 实例的共享会话中协作产出可播放的 .wav。

    推荐理由:原文给出可复现的三智能体音乐制作流水线代码与实测耗时,读者可据此迁移到其他长时 GPU 工作流。

  2. Google DeepMind71

    Google DeepMind 推出 SynthID Bio,为 AI 生成蛋白质嵌入可验证水印

    Google DeepMind 推出 SynthID Bio,将水印技术用于合成生物学,把不可感知的签名直接嵌入生物代码,使水印在数字模型和合成出的实体蛋白质上都能被验证,同时实验室测试显示其不损害蛋白质的生物功能。

    推荐理由:Google DeepMind 把水印从数字内容延伸到合成生物,读者可了解其技术路径与生物安全筛查的衔接方式。

  3. NVIDIA Blog60

    NVIDIA 与 CoreWeave 将 Vera Rubin NVL72 投入生产,Cognition 为首家客户

    CoreWeave 宣布在 CoreWeave Cloud 上提供 NVIDIA Vera Rubin NVL72 系统与 Spectrum-X 102.4T 以太网网络,成为首批交付该平台的云厂商之一,Cognition 是首个在生产环境运行 Vera Rubin 的客户。

    推荐理由:CoreWeave 上线 Vera Rubin NVL72 并公布 Devin 实测吞吐数据,可据此判断智能体编码的算力成本走向。