跳到正文

公司与模型

Hugging Face 最新动态

Hugging Face 开源社区动态:热门模型与数据集、排行榜变化与开源生态的晴雨表。

207 条精选近 30 天 7 条共收录 399 条

更新

精选归档 · 第 10 页

10月14日周五第 181–200 条
  1. Hugging Face Blog69

    Hugging Face 推出 Inference Endpoints 托管推理服务入门指南

    Hugging Face 正式推出 Inference Endpoints 托管服务,支持用户直接将 Hub 上的模型一键部署到云端基础设施。服务提供 Public、Protected 以及基于 AWS PrivateLink 的 Private 三种访问权限模式,并支持自定义容器和弹性伸缩配置。作者以图像分类模型实测了从受保护端点调用到配置 AWS VPC 私有连接的完整工程流程与监控指标。

    推荐理由:文章演示了直接从模型仓库到受保护或私有端点的云端部署全流程,为工程团队评估托管推理方案提供了实操参考。

10月13日周四
  1. Hugging Face Blog63

    Hugging Face Diffusers 支持 JAX/Flax 实现 Stable Diffusion TPU 并行推理

    Hugging Face 在 Diffusers 0.5.1 中加入对 JAX/Flax 的支持,允许用户在 Google TPU 上快速运行 Stable Diffusion 推理。利用 TPU 包含 8 个加速核心的特性,结合 jax.pmap 和 JIT 编译,系统可将参数与提示词分片后并行生成 8 张图片;在 TPU v2-8 上单次推理测试耗时约 7 秒。

    推荐理由:原文给出了基于 JAX/Flax 在 TPU 上并行运行 Stable Diffusion 的完整步骤与测速数据,便于开发者迁移到分布式推理环境。

10月7日周五
  1. Hugging Face Blog60

    Hugging Face Hub 支持为数据集与模型生成 DOI

    Hugging Face 宣布与 DataCite 合作,支持用户直接在 Hub 仓库设置中为模型和数据集生成数字对象标识符(DOI)。生成后访客可通过模型或数据集页面的按钮一键获取永久引用链接,相关资产更新时 DOI 也会同步更新以支持精确追踪特定版本。

    推荐理由:Hugging Face Hub 支持为模型和数据集直接生成学术 DOI,便于研究人员进行长期规范引用与版本追溯。

10月3日周一
  1. Hugging Face Blog65

    Hugging Face 详解超大语言模型零样本评测方法与实践

    Hugging Face 在 Evaluation on the Hub 中支持因果语言模型的零样本分类评测,依托升级后的 AutoTrain 基础设施免费支持最高 66B 参数的模型。

    推荐理由:平台通过无代码界面和升级的底层算力免费支持最高 66B 模型的零样本评测,降低了开发者验证大模型性能与偏见的门槛。

9月27日周二
  1. Hugging Face Blog74

    Hugging Face Accelerate 如何借助 PyTorch 运行超大模型

    Hugging Face 详细介绍了 Accelerate 库如何借助 PyTorch 特性在消费级硬件甚至免费 Colab 实例上加载并推理超大模型。该方案结合 PyTorch meta 设备先构建空模型骨架,通过自动设备映射(device_map)按需将层级分配至 GPU、CPU 内存或磁盘,并借助分块权重(sharded checkpoints)渐进式加载参数。

    推荐理由:文章详细拆解了通过 meta 设备、设备映射与分块加载实现超大模型显存卸载与推理的底层机制。

9月26日周一
9月12日周一
8月31日周三
  1. Hugging Face Blog67

    Hugging Face 详解 OpenRAIL:构建兼顾开源与责任的 AI 许可框架

    Hugging Face 撰文阐释 OpenRAIL 许可框架,旨在为机器学习产物提供兼顾开放访问与负责任使用的授权机制。文章指出模型不同于传统软件代码,现行开源协议无法约束恶意行为,OpenRAIL 通过引入基于行为的使用限制条款,并要求衍生模型继承该约束以防止滥用。

    推荐理由:文章系统阐述了传统开源协议在模型层面的不足,为理解现代AI开源协议中为何普遍加入使用限制条款提供了规范层背景。

8月22日周一
  1. Hugging Face Blog95

    基于 Diffusers 库运行与定制 Stable Diffusion 完整指南

    Hugging Face 官方发布了使用 Diffusers 库运行 Stable Diffusion 的实践指南,详解了潜空间扩散模型的工作原理与底层架构。文章阐明了 VAE、U-Net 和 CLIP 文本编码器的协同机制,并提供了从常规开箱即用调用到手动编写自定义去噪循环、替换调度器的完整代码实现。

    推荐理由:文章不仅提供了开箱即用的推理代码,还完整拆解了潜扩散模型各模块,方便读者按需替换调度器或定制生成管线。

8月17日周三
  1. Hugging Face Blog70

    Hugging Face 正式集成 bitsandbytes 8-bit 矩阵乘法支持大规模 Transformer 模型推理

    Hugging Face 宣布将 LLM.int8() 量化技术集成至 transformers 与 accelerate 库,支持在所有兼容的 Hugging Face 模型上进行 8-bit 推理。

    推荐理由:官方详解了基于 bitsandbytes 的 8-bit 量化集成细节与踩坑经验,对大模型轻量化部署与工程调优有直接参考价值。

7月14日周四
  1. Hugging Face Blog70

    Hugging Face 详解 BLOOM 176B 模型背后的训练与工程技术

    Hugging Face 详细公开了 176B 参数多语言大模型 BLOOM 背后的完整软硬件工程方案与训练实践。项目在 Jean Zay 超算上使用 384 块 80GB A100 GPU 耗时 3.5 个月完成 350B token 的训练,软件端结合 Megatron-LM 与 DeepSpeed 实现了由张量并行、流水线并行及 ZeRO-1 组成的三维并行。

    推荐理由:文章详细拆解了千亿参数模型训练中的硬件网络配置与多维并行策略,为超大规模集群工程落地提供了真实参考。

7月12日周二
  1. Hugging Face Blog80

    BigScience 正式发布开源多语言大模型 BLOOM

    BigScience 正式发布 176B 参数的开源多语言大语言模型 BLOOM,能够生成 46 种自然语言与 13 种编程语言的文本。该模型由来自 70 多个国家的研究人员历时 117 天在法国 Jean Zay 超级计算机上训练完成,并同步开源了训练中间检查点和优化器状态。

    推荐理由:该模型完整公开了训练检查点与优化器状态,为学术界深入研究百亿级以上多语言模型的内部机理提供了开放样本。

6月28日周二
  1. Hugging Face Blog71

    Hugging Face 推出 Evaluation on the Hub 免代码模型评估工具

    Hugging Face 宣布推出基于 AutoTrain 的新工具 Evaluation on the Hub,支持用户无需编写代码即可在平台任意数据集上评估模型。该功能允许用户配置任务、数据集切分及评估指标,评估完成后会自动向对应模型卡提交包含测试结果的 Pull Request,并生成配套排行榜以供比对。

    推荐理由:该工具将模型评估流程与平台数据集和模型卡直接打通,降低了复现和多指标基准测试的门槛。

6月7日周二
  1. Hugging Face Blog71

    带注释的扩散模型:DDPM 理论与 PyTorch 逐步实现

    Hugging Face 官方发布去噪扩散概率模型(DDPM)的带注释实战教程,系统讲解离散时间扩散模型的数学原理并提供完整的 PyTorch 逐步实现。教程基于 U-Net、正弦位置嵌入和注意力机制构建噪声预测网络,详细演示了前向加噪过程、均值重参数化损失计算、Fashion-MNIST 训练与反向去噪采样流程。

    推荐理由:原文完整拆解了 DDPM 的数学原理与 PyTorch 核心实现,读者可以据此掌握扩散模型的加噪去噪机制与训练全流程。

5月25日周三
  1. Hugging Face Blog72

    Hugging Face Hub 正式上线 Pull Request 与 Discussions 功能

    Hugging Face Hub 在模型、数据集和 Spaces 全类型仓库中正式上线 Pull Request 与 Discussions 协作功能。与 GitHub 等平台不同,该功能无需创建 fork,贡献者直接向源仓库的特殊 ref 分支推送更改,并在统一的 Community 标签页中集中管理讨论与代码合并。

    推荐理由:该机制去除了传统平台的 fork 流程,读者可以据此了解机器学习社区针对大文件仓库设计的轻量协作模式。

5月16日周一
  1. Hugging Face Blog80

    Gradio 3.0 正式发布:前端全面重构并推出 Blocks API

    Gradio 正式发布 3.0 版本,前端采用 Svelte 全面重构并推出了支持自定义布局与数据流的 Blocks API。新版本显著缩减了资源体积并提升页面加载速度,新增 Gallery 组件和 TabbedInterface 多标签界面,同时改进了 Dataframe 组件交互。

    推荐理由:Gradio 3.0 重构了前端并推出 Blocks API,开发者无需编写复杂前端代码即可直接用纯 Python 自由定制页面布局与多步骤数据流。

5月10日周二
5月9日周一
  1. Hugging Face Blog67

    Hugging Face 完成 1 亿美元 C 轮融资推动开源与协作式机器学习

    Hugging Face 宣布完成由 Lux Capital 领投的 1 亿美元 C 轮融资,Sequoia 和 Coatue 等机构跟投。新融资将用于加码科研、开源生态、产品研发以及招募人才。目前该平台已托管超过 10 万个预训练模型和 1 万个数据集,服务逾万家企业,并正在推进 BigScience 开源多语言大语言模型项目。

    推荐理由:关注开源机器学习基础设施商业化进展的读者可以通过这笔融资了解社区平台在研究与产品上的扩张方向。

5月4日周三
  1. Hugging Face Blog61

    Hugging Face 深度强化学习入门教程与基础概念解析

    Hugging Face 发布免费深度强化学习课程第一单元,系统介绍强化学习的核心概念、数学框架与实践路径。内容涵盖智能体与环境交互机制、奖励假设、折扣率、状态与动作空间,并对比了基于策略与基于价值两大求解路线及神经网络的作用。教程提供配套实践指南,支持读者训练月球着陆智能体并一键上传至 Hugging Face Hub。

    推荐理由:原文系统梳理了强化学习的核心框架与策略价值方法差异,读者可以通过配套代码实践将训练好的智能体发布至 Hub。

12月21日周二