跳到正文

公司与模型

Hugging Face 最新动态

Hugging Face 开源社区动态:热门模型与数据集、排行榜变化与开源生态的晴雨表。

207 条精选近 30 天 7 条共收录 399 条

更新

精选归档 · 第 7 页

2月4日周二第 121–140 条
2月2日周日
  1. Hugging Face Blog73

    Hugging Face 发布 Open-R1 首期进展:成功复现评估基准并跑通训练与数据管线

    Hugging Face 公布 Open-R1 项目启动一周的复现进展,团队已在 MATH-500 基准上成功复现 DeepSeek-R1 蒸馏系列模型的评测成绩。

    推荐理由:文中梳理了复现 DeepSeek-R1 的评测基准,并给出了通过 TRL 运行 GRPO 训练以及流式并发生成长推理链数据的工程优化方案。

1月28日周二
  1. Hugging Face Blog66

    Hugging Face 启动 Open-R1 项目以完全开源复现 DeepSeek-R1

    Hugging Face 宣布启动 Open-R1 开源项目,旨在全面复现 DeepSeek-R1 的训练流程并补全其未开源的数据集与代码。该计划分为三步,包括通过数据蒸馏复现 R1-Distill 模型、构建数学与代码数据集复现基于 GRPO 的纯强化学习流程,以及完整走通从基础模型到 SFT 再到 RL 的多阶段训练。

    推荐理由:原文梳理了 DeepSeek-R1 缺失的训练代码与数据集环节,并给出了开源社区全流程复现推理模型的具体实施路线。

1月27日周一
  1. Hugging Face Blog76

    Hugging Face Diffusers 开源视频生成模型现状与推理优化实践

    Hugging Face 梳理了当前开源视频生成模型生态,并在 Diffusers 中提供了一整套低显存推理与微调支持方案。通过结合 4-bit 量化、分块 VAE 解码、层级转换与模块级 CPU 卸载,团队将混元视频 HunyuanVideo 的显存需求从原生的 60GB 压缩至约 6.5GB。

    推荐理由:文章系统拆解了开源视频模型的推理痛点,提供了将超大模型显存占用压缩至消费级显卡的工程优化组合方案。

1月24日周五
  1. Hugging Face Blog72

    Hugging Face 开源智能体框架 smolagents 正式支持视觉多模态模型

    Hugging Face 宣布其开源智能体框架 smolagents 正式支持视觉语言模型(VLM),让智能体能够在执行管线中原生处理图像。框架支持在启动时通过 run 方法直接传入图像列表,也支持通过每步回调函数将网页截图等动态图像写入记忆观察。官方提供了结合 helium 浏览器自动化工具与 Qwen2-VL 等模型构建自主网页浏览 Agent 的完整示例。

    推荐理由:原文给出了静态传入与动态回调两种图像输入方案及完整代码,读者可据此为轻量智能体工作流增加多模态感知能力。

1月23日周四
1月16日周四
  1. Hugging Face Blog61

    Hugging Face 为 TGI 引入多后端架构,支持 TensorRT-LLM 与 vLLM 等引擎

    Hugging Face 宣布为 Text Generation Inference(TGI)引入多后端架构,允许将其作为统一前端层接入 TensorRT-LLM、vLLM、llama.cpp 等多种底层推理引擎。

    推荐理由:原文阐述了将 TGI 作为统一前端接入多种推理引擎的架构设计,读者可以了解跨硬件推理服务的解耦与选型方案。

1月15日周三
  1. Hugging Face Blog71

    Hugging Face 发布高速静态嵌入模型并开源训练方案

    Hugging Face 推出了一种基于 Sentence Transformers 的静态嵌入模型训练方法,并发布了面向英文检索的 static-retrieval-mrl-en-v1 和面向多语言相似度的 static-similarity-mrl-multilingual-v1 两个模型。

    推荐理由:针对端侧和低功耗检索场景,本文公开了低延迟静态嵌入模型的完整对比数据与训练配置。

12月31日周二
  1. Hugging Face Blog82

    Hugging Face 发布轻量级智能体库 smolagents

    Hugging Face 正式推出轻量级开源智能体库 smolagents,主打让大语言模型直接通过可执行 Python 代码来表达与调用工具动作。该库核心代码仅约千行并支持 E2B 沙盒执行环境,未来将取代旧版 transformers.agents。它深度集成了 Hugging Face Hub 工具生态,并可通过 LiteLLM 接入开源模型及主流商业模型。

    推荐理由:原文展示了用可执行代码替代传统 JSON 工具调用的智能体设计,为需要高灵活性与轻量化架构的开发者提供了参考。

12月24日周二
  1. Hugging Face Blog67

    PyTorch 训练显存可视化与占用估算指南

    教程详解了如何使用 PyTorch 内置快照工具可视化 GPU 显存,并系统拆解了大语言模型训练全流程中的显存变化机制。显存峰值取决于模型参数、优化器状态以及激活值与优化器中间变量的最大值,文中还基于参数量拟合出了激活值的近似线性估算公式。

    推荐理由:文章拆解了大模型训练各阶段的显存占用,并给出参数量与激活值的线性估算公式,方便排查显存溢出与预估硬件需求。

10月22日周二
5月28日周二
  1. Hugging Face Blog70

    使用 Sentence Transformers 训练与微调嵌入模型指南

    Hugging Face 发布使用 Sentence Transformers 训练和微调嵌入模型的实操指南,系统梳理了数据集格式匹配、损失函数选择、评估器及 SentenceTransformerTrainer 的核心用法。

    推荐理由:文章给出了基于新版训练器微调嵌入模型的完整组件配置与多数据集训练范式,可直接用于检索与RAG任务优化。

5月24日周五
9月15日周五
  1. Hugging Face Blog65

    Hugging Face 发布大语言模型生产环境推理优化指南

    Hugging Face 发布大语言模型生产部署优化指南,系统梳理低精度量化、Flash Attention 与架构设计三大提效手段。文章结合 OctoCoder 等模型实测,展示 8-bit 与 4-bit 量化将显存占用从 32GB 降至 15GB 与 9.5GB,以及 Flash Attention 降低显存占用并提升生成速度的实现方式。

    推荐理由:系统梳理了量化、Flash Attention 与架构优化三类推理工程方案,读者可据此排查大模型线上部署的显存与延迟瓶颈。

9月13日周三
  1. Hugging Face Blog75

    快速图像生成扩散模型 Würstchen 发布

    文生图扩散模型 Würstchen 正式发布并集成至 Diffusers,通过两阶段压缩技术实现 42x 空间压缩率。其文本条件先验模型在高度压缩的潜在空间运行,相较于 SDXL 显著提升了生成速度并降低显存占用,Würstchen v1 的训练成本较 SD1.4 降低约 16 倍。

    推荐理由:该模型通过两阶段压缩实现 42 倍空间压缩率,为大幅降低文生图训练算力与推理显存提供了可行方案。

9月12日周二
9月8日周五
9月6日周三
  1. Hugging Face Blog79

    TII 发布 1800 亿参数大模型 Falcon 180B 并上线 Hugging Face

    TII 正式发布 1800 亿参数的大语言模型 Falcon 180B,并在 Hugging Face Hub 同步上线基础模型与对话模型。该模型基于 RefinedWeb 数据集在 3.5 万亿 token 上完成预训练,多项基准测试表现超越 Llama 2 70B 并逼近 PaLM-2 Large。

    推荐理由:原文梳理了该开源大模型的训练规模与基准表现,并提供了涵盖微调与量化推理的具体硬件配置参考。