跳到正文

技术方向

开源生态 最新动态

开源模型、框架与仓库动态:权重开放、社区项目爆火、开源与闭源的力量消长。

252 条精选近 30 天 16 条共收录 467 条

更新

精选归档 · 第 13 页

12月21日周二第 241–252 条
7月28日周三
  1. OpenAI News66

    OpenAI 发布开源 GPU 编程语言 Triton 1.0

    OpenAI 正式发布开源编程语言 Triton 1.0,面向神经网络计算提供类 Python 的 GPU 编程环境。该语言允许没有 CUDA 经验的研究人员编写高效 GPU 代码,其运行效率在多数情况下可达到专业人员手写代码的水平。

    推荐理由:该项目降低了高性能GPU编程门槛,使无CUDA经验的研究人员也能编写接近专家级效率的硬件代码。

6月28日周一
  1. Hugging Face Blog67

    Sentence Transformers 正式集成至 Hugging Face Hub

    Sentence Transformers 正式集成至 Hugging Face Hub,提供覆盖 100 多种语言的 90 余个预训练嵌入模型。Hub 为其新增特征提取与句子相似度计算交互组件,并支持通过 Inference API 在线调用。开发者还可以使用 save_to_hub 将训练好的模型直接上传至 Hub,系统会自动生成模型卡片并启用在线推理功能。

    推荐理由:原文展示了平台对句子嵌入模型的在线交互与快捷托管支持,为语义检索模型的分享和快速调用提供了完整链路。

5月25日周二
  1. Hugging Face Blog70

    在 Gradio 2.0 中使用与组合 Hugging Face 模型

    Gradio 2.0 支持仅用一行代码为 Hugging Face 上的机器学习模型快速生成交互界面。该功能默认调用 Hugging Face 托管的推理 API,也支持在本地运行 transformers 进行计算。开发者还可以将多个模型并行对比或串行串联,以极简代码快速组合出翻译、摘要等复杂应用。

    推荐理由:原文介绍了通过一行代码为模型生成交互界面的机制,读者可以据此掌握并行对比与串联多模型的组合方法。

4月16日周五
  1. Hugging Face Blog74

    Hugging Face 推出开源库 Accelerate

    Hugging Face 推出开源库 Accelerate,允许开发者仅需在原生 PyTorch 训练循环中添加数行代码,即可统一运行在多 GPU、TPU 以及混合精度等不同硬件配置上。该库通过统一 API 抽象底层样板代码,自动处理设备放置与数据分发,并提供配置向导与 CLI 启动命令以简化分布式训练脚本的执行。

    推荐理由:原文对比了原生PyTorch分布式模板代码与简化改动,读者可以借此评估统一多设备训练脚本的迁移成本。

3月23日周二
  1. Hugging Face Blog60

    Hugging Face 与 Amazon SageMaker 达成战略合作并推出官方深度学习容器

    Hugging Face 宣布与 Amazon 达成战略合作并将 AWS 作为首选云服务商,联合推出集成 Transformers 的 Amazon SageMaker 深度学习容器(DLCs)与 Python SDK 扩展。

    推荐理由:原文详细说明了如何结合托管容器与分布式库训练模型,工程师可据此评估在云端批量微调与部署开源模型的成本与流程。

4月30日周四
  1. OpenAI News74

    OpenAI 推出音乐生成模型 Jukebox 并开源代码与权重

    OpenAI 推出音乐生成神经网络 Jukebox,能够直接以原始音频形式生成包含多种流派、艺术家风格以及初步歌声的音乐。官方已同步开源该模型的权重与代码,并提供了用于试听和浏览生成音频样本的工具。

    推荐理由:OpenAI开源了可直接生成原始音频与歌声的音乐生成模型及代码,为音频多模态生成研究提供了可复现的参考实现。

3月1日周日
  1. Hugging Face Blog66

    Hugging Face 详解 Transformers 文本生成解码方法

    Hugging Face 官方发布博客,系统梳理了使用 Transformers 库进行自回归文本生成时的主要解码策略及代码实现。文章对比了贪婪搜索、束搜索(Beam search)以及温度采样、Top-K 和核采样(Top-p)的生成表现,分析了重复生成等常见缺陷的成因与缓解方案。开发者可通过调整 generate 接口的参数快速组合不同解码方式,以平衡生成文本的多样性与连贯性。

    推荐理由:教程梳理了自回归生成的多种解码策略及其优缺点,读者可以掌握在 transformers 库中配置参数调优文本质量的方法。

2月14日周五
  1. Hugging Face Blog62

    如何使用 Transformers 与 Tokenizers 从零训练新的语言模型

    Hugging Face 官方发布教程,演示如何使用 transformers 与 tokenizers 库从零预训练一个 84M 参数量的类 RoBERTa 语言模型 EsperBERTo 并微调。

    推荐理由:文章完整演示了从词表构建、预训练到下游微调的端到端流程,为小语种或专用领域训练语言模型提供了清晰实践范式。

1月30日周四
11月5日周二
  1. OpenAI News86

    OpenAI 正式发布 GPT-2 1.5B 完整模型与代码权重

    OpenAI 正式发布 GPT-2 分阶段发布计划中的最大版本(1.5B 参数),并同步公开代码与模型权重以协助检测生成内容。尽管此前已有更大规模语言模型推出,官方仍按原计划完成分阶段发布流程,旨在为未来大模型开发者提供负责任发布的实践测试范例。

    推荐理由:OpenAI 完成了 GPT-2 的分阶段发布并公开完整权重与检测代码,为后续大模型的负责任发布流程提供了实践参考。

11月8日周四
  1. OpenAI News64

    OpenAI 发布深度强化学习教育资源 Spinning Up in Deep RL

    OpenAI 推出深度强化学习教育资源 Spinning Up in Deep RL,旨在帮助任何人掌握深度强化学习技能并成为实践者。该项目包含清晰的强化学习代码示例、配套练习、参考文档以及系统教程。

    推荐理由:该项目整理了规范的强化学习代码示例与配套习题文档,为想要掌握深度强化学习的开发者提供了实践路径。