跳到正文

全部动态

今日 4 条
10月10日周四
10月9日周三
10月8日周二
10月5日周六
  1. Hugging Face Blog26

    Hugging Face 如何改进 Hub 上 Parquet 文件的去重效率

    Hugging Face 的 Xet 团队针对 Hub 上超 2.2PB 的 Parquet 存储测试了字节级 CDC 去重效果:追加 10,000 行可去重 99.1%,仅需额外 20MB;但修改一行因列头含绝对偏移量,去重率降至 89%,需额外 230MB。团队提出改用相对偏移量、按行组做内容定义分块等方案,并希望与 Apache Arrow 合作落地。

10月4日周五
  1. Hugging Face Blog28

    Hugging Face 推出 Open FinLLM Leaderboard:金融大模型专用评测榜单

    Hugging Face 发布 Open FinLLM Leaderboard,为金融场景提供专门的 LLM 评测框架,覆盖信息抽取、文本分析、问答、文本生成、风险管理、预测和决策七大类任务。榜单采用零样本评测,使用 Accuracy、F1、ROUGE 和 MCC 等指标,数据集来自金融行业真实挑战,如信用评分、欺诈检测和股价走势预测。

10月3日周四
10月2日周三
10月1日周二
  1. OpenAI News62

    OpenAI 发布 Realtime API

    OpenAI 发布 Realtime API,开发者现在可以在自己的应用中构建快速的语音到语音体验。

    推荐理由:OpenAI 官方发布 Realtime API,开发者可据此判断语音到语音交互的接入方式。

  2. OpenAI News62

    OpenAI 在 API 中推出 Prompt Caching

    OpenAI 在 API 中推出 Prompt Caching,对模型近期已见过的输入提供自动折扣。该功能面向重复使用相同输入内容的调用场景,无需额外配置即可获得输入费用优惠。

    推荐理由:OpenAI 官方公布 API 提示词缓存机制,读者可了解重复输入自动折扣对调用成本的影响。

  3. Hugging Face Blog22

    BenCzechMark:你的 LLM 能理解捷克语吗?

    Hugging Face 发布 BenCzechMark,首个面向捷克语的大语言模型综合评测套件,涵盖 9 大类共 50 项任务,其中 90% 为原生非翻译内容。配套榜单已收录超过 25 个不同规模的开源模型,任务采用 Acc、EM、AUROC、Ppl 等指标,并区分阅读理解、事实知识、捷克语理解、语言建模、数学推理、自然语言推理、命名实体识别、情感分析与文档检索等类别。

9月30日周一
  1. Hugging Face Blog31

    如何将顶点着色网格转换为 UV 贴图纹理网格

    Hugging Face 发布教程与 InstantTexture 库,可将 InstantMesh 等生成模型输出的顶点着色网格转换为 UV 贴图纹理网格。流程用 xatlas 生成 UV 映射,再通过重心坐标插值填充 1024 像素纹理,并配合修复、中值滤波、高斯模糊与 LANCZOS 降采样消除空洞。该库可通过 pip 安装,将 .obj 网格转换为 .glb 输出。

9月26日周四
9月25日周三
9月24日周二
9月23日周一
9月20日周五
9月19日周四
9月18日周三
9月17日周二
  1. Mistral AI72

    Mistral AI 发布 Pixtral 12B 多模态模型

    Mistral AI 发布 Pixtral 12B,一个原生多模态模型,采用新训练的 400M 参数视觉编码器和基于 Mistral Nemo 的 12B 多模态解码器,支持可变图像尺寸与 128k token 上下文窗口内的多图输入,以 Apache 2.0 许可开源。

    推荐理由:官方给出架构、评测协议与多模态基准对比,可据此判断 12B 级开源多模态模型的真实能力边界。