跳到正文

内容形态

产品更新 最新动态

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

143 条精选近 30 天 16 条共收录 268 条

更新

精选归档 · 第 7 页

7月24日周一第 121–140 条
7月20日周四
6月7日周三
  1. Hugging Face Blog71

    Hugging Face Hub 支持通过 DuckDB 直接对 5 万多个数据集执行 SQL 查询

    Hugging Face Hub 宣布集成 DuckDB,允许开发者直接针对 Hub 上存储的 50,000 多个公开数据集运行 SQL 分析查询。Dataset Viewer 会将数据集自动转换为 Parquet 列式存储文件并切分为 500MB 分片,用户可通过 /parquet 端点获取文件链接。

    推荐理由:平台将公开数据集自动转为 Parquet 分片,开发者借助 DuckDB 的远程读取能力即可免下载执行复杂 SQL 查询。

5月31日周三
  1. Hugging Face Blog69

    Hugging Face 推出适用于 Amazon SageMaker 的 LLM 推理容器

    Hugging Face 推出基于 Text Generation Inference(TGI)的全新 SageMaker LLM 深度学习容器(DLC),用于在托管环境中部署 BLOOM、Llama 和 Falcon 等开源大语言模型。

    推荐理由:文章给出了在云端托管大模型的专用容器方案,读者可以据此将开源模型低成本接入企业级生产环境。

5月24日周三
  1. Hugging Face Blog60

    Hugging Face 联合微软在 Azure 上线模型目录功能

    Hugging Face 宣布与微软合作,在 Azure Machine Learning Studio 中原生集成 Hugging Face Hub 模型目录,支持数千个热门 Transformers 模型的一键部署。开发者可直接在托管端点上运行实时推理 API,在兼顾企业安全与合规要求的同时简化部署流程。该功能已在所有提供 Azure Machine Learning 的区域开启公开预览。

    推荐理由:原生集成降低了企业在合规云环境内部署开源模型的门槛,读者可借此评估其托管推理端点的适配流程。

5月15日周一
  1. Hugging Face Blog73

    Hugging Face transformers 库正式集成 RWKV 架构

    Hugging Face 宣布将兼具 RNN 与 Transformer 优势的 RWKV 架构正式集成至 transformers 库。该架构在训练时支持并行化且速度超越传统模型,推理时具备固定显存占用和线性计算效率,覆盖 170M 至 14B 参数。

    推荐理由:Hugging Face 将结合 RNN 与 Transformer 优势的 RWKV 架构原生接入 transformers 库,方便开发者直接调用线性复杂度的开源模型。

5月11日周四
  1. Hugging Face Blog78

    Hugging Face 推出辅助生成技术,大幅降低大模型文本生成延迟

    Hugging Face 在 Transformers 库中引入辅助生成(Assisted Generation)解码方法,利用同分词器的小模型预先生成候选 token 并由目标模型批量前向验证,最高可将文本生成延迟降低 10 倍。

    推荐理由:通过小模型预先生成候选并由主模型单次前向验证,它在显存受限或内存卸载场景下给出了降低文本生成延迟的具体工程方案。

11月17日周四
  1. Hugging Face Blog69

    Hugging Face 与 arXiv 达成合作,在论文页面上线机器学习 Demo 标签页

    Hugging Face 宣布与 arXiv 展开合作,通过 arXivLabs 在 arXiv 论文摘要页面新增 Demos 标签页,直接接入 Hugging Face Spaces 上的开源演示。读者无需运行本地代码即可在浏览器中直接体验作者或社区构建的交互式模型;这些 Demo 基于 Gradio 和 Streamlit 构建,旨在降低成果检验与复现门槛。

    推荐理由:该功能打通了论文预印本与交互式演示,研究者和读者无需本地部署即可直接在 arXiv 页面验证论文模型效果。

11月8日周二
  1. Hugging Face Blog62

    Transformers 支持 Contrastive Search 解码:兼顾流畅度与连贯性的文本生成实践

    Hugging Face 在 transformers 4.24.0 中集成了对比搜索解码算法,支持 PyTorch 与 TensorFlow 双框架。该方法结合模型预测置信度与表征退化惩罚项,通过计算候选 token 与已有上下文的余弦相似度,避免贪婪搜索引起的文本循环重复以及核采样的语义漂移。

    推荐理由:文章通过退化惩罚项平衡模型置信度与表征相似度,为解决大语言模型生成重复与语义不连贯问题提供了兼顾连贯与多样性的实用解码方案。

  2. Hugging Face Blog60

    Hugging Face 公布全新定价体系并调整推理服务

    Hugging Face 正式更新平台定价与计费体系,下线 Inference API 付费层并保留免费版本,推荐需要企业级推理的用户改用 Inference Endpoints。同时 Spaces 新增自定义硬件升级能力,相关付费服务无需预先订阅,只需在账单中心绑定支付方式即可按需使用,每月初统一出具合并账单。

    推荐理由:原文明确了免费推理与托管算力的分工变化,团队可据此评估使用官方端点与自建服务的成本差异。

10月7日周五
  1. Hugging Face Blog60

    Hugging Face Hub 支持为数据集与模型生成 DOI

    Hugging Face 宣布与 DataCite 合作,支持用户直接在 Hub 仓库设置中为模型和数据集生成数字对象标识符(DOI)。生成后访客可通过模型或数据集页面的按钮一键获取永久引用链接,相关资产更新时 DOI 也会同步更新以支持精确追踪特定版本。

    推荐理由:Hugging Face Hub 支持为模型和数据集直接生成学术 DOI,便于研究人员进行长期规范引用与版本追溯。

10月3日周一
  1. Hugging Face Blog65

    Hugging Face 详解超大语言模型零样本评测方法与实践

    Hugging Face 在 Evaluation on the Hub 中支持因果语言模型的零样本分类评测,依托升级后的 AutoTrain 基础设施免费支持最高 66B 参数的模型。

    推荐理由:平台通过无代码界面和升级的底层算力免费支持最高 66B 模型的零样本评测,降低了开发者验证大模型性能与偏见的门槛。

9月28日周三
9月12日周一
8月31日周三
8月17日周三
  1. Hugging Face Blog70

    Hugging Face 正式集成 bitsandbytes 8-bit 矩阵乘法支持大规模 Transformer 模型推理

    Hugging Face 宣布将 LLM.int8() 量化技术集成至 transformers 与 accelerate 库,支持在所有兼容的 Hugging Face 模型上进行 8-bit 推理。

    推荐理由:官方详解了基于 bitsandbytes 的 8-bit 量化集成细节与踩坑经验,对大模型轻量化部署与工程调优有直接参考价值。

6月28日周二
  1. Hugging Face Blog71

    Hugging Face 推出 Evaluation on the Hub 免代码模型评估工具

    Hugging Face 宣布推出基于 AutoTrain 的新工具 Evaluation on the Hub,支持用户无需编写代码即可在平台任意数据集上评估模型。该功能允许用户配置任务、数据集切分及评估指标,评估完成后会自动向对应模型卡提交包含测试结果的 Pull Request,并生成配套排行榜以供比对。

    推荐理由:该工具将模型评估流程与平台数据集和模型卡直接打通,降低了复现和多指标基准测试的门槛。

5月25日周三
  1. Hugging Face Blog72

    Hugging Face Hub 正式上线 Pull Request 与 Discussions 功能

    Hugging Face Hub 在模型、数据集和 Spaces 全类型仓库中正式上线 Pull Request 与 Discussions 协作功能。与 GitHub 等平台不同,该功能无需创建 fork,贡献者直接向源仓库的特殊 ref 分支推送更改,并在统一的 Community 标签页中集中管理讨论与代码合并。

    推荐理由:该机制去除了传统平台的 fork 流程,读者可以据此了解机器学习社区针对大文件仓库设计的轻量协作模式。

5月16日周一
  1. Hugging Face Blog80

    Gradio 3.0 正式发布:前端全面重构并推出 Blocks API

    Gradio 正式发布 3.0 版本,前端采用 Svelte 全面重构并推出了支持自定义布局与数据流的 Blocks API。新版本显著缩减了资源体积并提升页面加载速度,新增 Gallery 组件和 TabbedInterface 多标签界面,同时改进了 Dataframe 组件交互。

    推荐理由:Gradio 3.0 重构了前端并推出 Blocks API,开发者无需编写复杂前端代码即可直接用纯 Python 自由定制页面布局与多步骤数据流。