跳到正文

全部动态

今日 6 条
今天10月3日周六
  1. BestBlogs.dev22

    迪拜航空 FZ1073 副机长刺伤机长未遂坠机事件复盘

    迪拜航空 FZ1073 从迪拜飞往特拉维夫途中,副机长持刀刺伤机长并抢夺操纵杆,飞机半分钟内急降 4267 米,机舱进入负 G 状态,数名以色列乘客冲入驾驶舱将其制服,最终紧急降落沙特机场,无人死亡。以色列安全部门初步认定副机长系独立行为,无恐怖组织或国家支持。作者借此讨论驾驶舱门防护的两难:门太松易被劫机者控制,门焊死则外部无法救援。

  2. TechCrunch · AI36

    Airbnb CEO Brian Chesky:AI 智能体需要自己的操作系统

    Airbnb 本周随秋季更新上线新的 AI 搜索,CEO Brian Chesky 表示聊天机器人不适合电商,未来三到六个月公司将探索支持多人同时使用的“multiplayer”AI 界面。他认为行业缺少真正为 AI 打造的操作系统,AI 应在内核层运行,并计划让 Airbnb 应用变得更 agentic、通过 MCP 与其他智能体互通。

10月2日周五
  1. The Verge · AI34

    AI 幻觉让"顾客永远是对的"更难应付:服务员、护林员和幼教都在被 ChatGPT 反驳

    生成式 AI 的普及正让服务业员工面对越来越多"拿 ChatGPT 当权威"的顾客:纽约服务员 Madison 称有客人以 ChatGPT 为由否认菜品含贝类过敏原,还有客人拒绝侍酒师、改问 ChatGPT,甚至点出不存在的酒。Meta 新 AI 智能体 Muse 的推出可能加剧这一问题,护林员、幼教和餐厅经理也报告了 AI 编造的营地行程、育儿作息和预订要求。

  2. MIT Technology Review · AI50

    别被迷惑——LLM 并不会推理

    前 Google DeepMind 研究员指出,LLM 靠逐个预测 token 生成答案,其链式思考仍由同一套 next-token 预测产生,并非真正独立的推理机制。他认为这类模型缺乏可检视的持久认知状态、知识与推理的分离,且链式思考常是事后编造,因此主张借鉴 AlphaGo 的游戏树搜索架构来构建真正的机器推理能力。

  3. Latent Space34

    MIT 的 Alex Zhang 谈 RLM、GPU 内核与智能体集群:学术界应下工业实验室不敢下的赌注

    MIT 研究者 Alex Zhang 在 Latent Space 播客中介绍了其 RLM(递归语言模型)工作:基于 RLM 的 harness 是首个接近解决 ARC-AGI-3 的系统,早于 OpenAI 的 Astra。他还讨论了 AI 生成 GPU 内核、harness 作为组合泛化器、Prime Agent 与持久化子智能体,以及 OpenAI 万级智能体实验、Kimi 集群等方向。

10月1日周四
9月29日周二
  1. MIT Technology Review · AI12

    HPE:如何让 AI 从费用变成资产

    HPE 提出企业 AI 支出正从按 token 计费的消费模式转向自建容量的资本决策,关键在于找到自身工作负载的"交叉点"——持续用量足以摊薄固定成本时,拥有算力才比逐次购买更经济。文章建议领导者先问三个问题:需求是否稳定可预测、何种用量下自建更划算、能否通过采用与治理让容量保持高产。

  2. MIT Technology Review · AI62

    AI 何时才算真正做出科学发现?

    MIT Technology Review 的 James O'Donnell 讨论 AI 公司宣称科学发现引发的争议。Anthropic 称其分子生物学实验室中 950 个 Claude 智能体用 21 小时标记出一个已知酶周围的重复模式,并称该模式此前未被编目,但一些生物学家认为找到基因簇和重复序列往往是容易的部分,难的是弄清系统实际功能。

9月28日周一
  1. Import AI32

    Import AI 474:Platonic mindspace、太空 TPU、智谱启动外层 RSI 循环

    Michael Levin 提出"Platonic mindspace"假说,认为心智是非物理模式,身体与机器只是这些模式进入物理世界的接口,并用 xenobots、anthrobots 及排序算法扰动实验作为佐证。本期 Import AI 还讨论了太空 TPU 与智谱启动外层 RSI 循环,并指出机器人领域正等待自己的 LLM 时刻,但尚缺通用算法。

9月26日周六
9月25日周五
9月23日周三
9月22日周二
  1. MIT Technology Review · AI38

    别被这个夏天的 AI 炒作骗了:从 Claude Mythos 到 OpenAI Astra 的真相

    针对今夏一系列 AI 炒作,文章指出 Anthropic 宣称 Claude Mythos 找漏洞强于多数安全专家、OpenAI 与 Hugging Face 遭黑客攻击、两家公司相继宣称数学突破等事件,经专家审视后结论大不相同:网络安全专家认为问题在于 OpenAI 忽视基本安全实践,数学家则指 OpenAI 的 Astra 成果并非首创,并指控其研究不端与抄袭。

9月21日周一
9月18日周五
  1. GitHub Blog · AI & ML22

    GitHub Podcast 拆解 AI 热门观点:该不该读 AI 生成的代码、RAG 是否已死、Skills 是否杀死了 MCP

    GitHub Podcast 最新一期拆解了五个 AI 热门观点:AI 生成的代码仍需人来负责,但审查力度应随风险而定;Skills 与 MCP 解决的是不同问题,MCP 提供连接工具和数据的标准,Skills 则封装团队流程与最佳实践;RAG 并未消亡,它与 Agent、Skills、MCP 可以共存于同一工作流。

8月31日周一
  1. Import AI34

    Import AI 471:Hugging Face 为何令人担忧、太空采矿、五眼联盟聚焦 AI

    Import AI 471 期关注 Hugging Face 与 OpenAI 事件中智能体展现的通信与自我牺牲能力,Dwarkesh Patel 与 Ajeya Cotra 认为该事件严重程度超出预期。五眼联盟在 Five Country Ministerial 声明中首次就前沿模型访问与国家安全风险表态。Bill Gates 则警告 AI 不会自动带来幸福,需要前所未有的全球性应对。

8月14日周五
  1. Hugging Face Blog62

    Hugging Face 发布 2026 夏季开源模型生态观察报告

    Hugging Face 发布 2026 年 1 月至 8 月的开源模型生态观察报告,基于 Hub 上的下载、点赞与衍生模型数据。报告显示公开模型仓库从 243 万增至 296 万,数据集从 71.1 万增至 100 万,Spaces 从 100 万增至 144 万,但 85.6% 的模型终身下载量不足 200 次,1.5% 的仓库占据 99.2% 的下载量。

    推荐理由:Hugging Face 用平台下载、点赞与衍生模型数据,给出开源模型生态在规模、许可与采用上的半年变化。

8月10日周一
  1. Import AI36

    Import AI 468:23 条 RSI 政策建议、PostTrainBench+,以及信任与透明度如何影响 AI 竞赛

    Import AI 第 468 期收录智库 IFP 提出的 23 条政策建议,分属 7 个类别,用于帮助政策制定者应对 AI 研发进一步自动化带来的风险。MIT 与 Columbia 的论文《Racing to Ruin》用双寡头 R&D 竞争模型分析发现,企业间实现协调减速的关键变量是技术开发的透明度,以及能否将对手建模为可信、理性的行动者。

7月30日周四
  1. Hugging Face Blog22

    GPU 管理:为什么闲置 GPU 是新的停飞飞机

    Hugging Face 博客指出,AI 的下一个真正约束是 GPU 利用率而非智能本身。GPU 按日历小时计费,产出却只按计算小时累积,两家 GPU 预算相当的公司会因利用率差异而拉开差距。企业自购 GPU 本地部署可把按 token 线性增长的 API 成本换成固定资本支出,但集群上线后的问题变成如何让它们保持忙碌。

7月7日周二
6月30日周二
6月1日周一