跳到正文

公司与模型

Hugging Face 最新动态

Hugging Face 开源社区动态:热门模型与数据集、排行榜变化与开源生态的晴雨表。

224 条精选近 30 天 8 条共收录 659 条

更新

精选归档 · 第 10 页

4月5日周六第 181–200 条
2月4日周二
1月31日周五
1月28日周二
12月31日周二
12月19日周四
  1. Hugging Face:Blog71

    Answer.AI 与 LightOn 发布 ModernBERT 编码器模型,支持 8192 序列长度并全面超越 BERT

    Answer.AI 与 LightOn 发布 ModernBERT 编码器模型系列,提供 base(149M 参数)和 large(395M 参数)两个规格,可作为 BERT 类模型的直接替代。

    推荐理由:原文详细披露了架构改进、训练数据和实测效率数字,读者可据此评估它在现有 BERT 类工作流中能否直接替换。

  2. Answer.AI 官方研发博客82

    Answer.AI 发布 ModernBERT:替代 BERT 的新一代编码器模型

    Answer.AI 与 LightOn 联合发布 ModernBERT,这是一系列旨在取代 BERT 的 SOTA 编码器模型。该模型将 LLM 的最新架构改进(如 Flash Attention、RoPE)应用于编码器,支持 8192 token 上下文长度(远超传统 BERT 的 512),并在速度和下游任务性能上全面超越旧一代模型。提供 base (149M) 和 large (395M) 两种参数规模,已集成至 Hugging Face Transformers v4.48.0,可直接作为 BERT 类模型的即插即用替代品,适用于 RAG、分类及代码检索等场景。

    推荐理由:这是六年来首个真正意义上对 BERT 架构的重大升级,解决了长上下文限制并提升了效率,对依赖编码器的 RAG 和搜索系统开发者具有直接的生产力价值。

12月16日周一
  1. Hugging Face:Blog60

    Hugging Face 发布 Synthetic Data Generator,用自然语言无代码生成数据集

    Hugging Face 团队发布 Synthetic Data Generator,这是一款无代码应用,通过三步流程用自然语言描述生成自定义合成数据集,后台由 distilabel 和免费的 Hugging Face 文本生成 API 驱动。

    推荐理由:原文给出从提示词到数据集再到训练模型的完整流程和速率、部署选项,读者可按需复用这套无代码生成方法。

11月4日周一
  1. Hugging Face:Blog60

    Argilla 2.4 发布:无需代码即可在 Hub 上构建微调与评估数据集

    Hugging Face 发布 Argilla 2.4,用户可从 Hub 任一公开数据集无代码导入,通过 Argilla UI 定义问题并收集人工反馈,用于构建微调和评估数据集。Hub 现有 230k 数据集可作为起点,部署在 Spaces 上默认启用 Hugging Face OAuth,允许任何 Hub 用户参与标注,也可配置为仅限协作者;后续仍可用 Python SDK 做进一步自定义。

    推荐理由:官方介绍了从 Hub 数据集无代码导入并收集人工反馈的完整流程,熟悉数据标注协作场景的读者可据此评估是否迁移现有工作流。

6月27日周四
2月21日周三
12月11日周一
11月9日周四
9月6日周三
7月18日周二
4月5日周三
3月9日周四
3月3日周五
1月2日周一
  1. Hugging Face:Blog65

    Hugging Face 教程:用 AI 在 5 天内开发农场游戏(第一篇,美术风格)

    Hugging Face 发布系列教程第一篇,讲解如何用 Stable Diffusion 为 Unity 农场游戏确定美术风格。文章涵盖用 Automatic1111 WebUI 本地部署或在线运行的方法、借助 lexica.art 优化提示词的技巧,以及用概念图指导 Unity 场景搭建、材质、灯光和后期处理的完整流程。

    推荐理由:系列第一篇给出用 Stable Diffusion 生成美术概念图并落地到 Unity 场景的完整步骤,方法可直接迁移到游戏开发流程。

12月21日周三