Graphite 研究:Claude Opus 5.5 最爱说“this matters”,GPT 模型写作习惯反而离人类越来越远
Graphite 研究发现 Claude Opus 5.5 的写作标志是“dependable”一词,出现频率是人类样本的 23 倍,“this matters”更是高出 116 倍;OpenAI 的 Astra 则偏爱“not simply X”式纠正性框架,出现频率超人类 100 倍。
Graphite 研究发现 Claude Opus 5.5 的写作标志是“dependable”一词,出现频率是人类样本的 23 倍,“this matters”更是高出 116 倍;OpenAI 的 Astra 则偏爱“not simply X”式纠正性框架,出现频率超人类 100 倍。
Import AI 第 469 期介绍了 DiG-bench(Discovery in Games)基准,包含 70 款规则与目标均隐藏、需靠交互探索发现的游戏,其中 21 款已公开。
Google 与康奈尔大学合作在 PNAS 发表研究,让 GPT-4o、Perplexity、Claude 3.5、Gemini Advanced Pro 1.5、NotebookLM 和一套自建 RAG 系统回答 67 道高温超导专家级问题,由国际专家小组按六项指标盲评打分。