OpenAI News·2025-02-18 18:00· 2025-02-18AI 评分36OpenAI 发布 SWE-Lancer 基准Introducing the SWE-Lancer benchmarkAI 导读OpenAI 发布 SWE-Lancer 基准,用于测试前沿 LLM 能否完成真实自由职业软件工程任务并赚取 100 万美元。该基准以真实外包项目为题目来源,衡量模型在实际软件工程工作中的变现能力。来源:OpenAI News · openai.com#评测/基准#编码#OpenAI