跳到正文

技术方向

开源生态 最新动态

开源模型、框架与仓库动态:权重开放、社区项目爆火、开源与闭源的力量消长。

37 条精选近 30 天 9 条共收录 65 条

更新

精选归档 · 第 2 页

4月5日周六第 21–37 条
  1. Hugging Face Blog94

    Meta 开源 Llama 4 Maverick 与 Scout,Hugging Face 全面集成并解析架构

    Meta 正式发布原生多模态 MoE 模型 Llama 4 Maverick 与 Scout,Hugging Face 宣布同步上线权重并提供全生态支持。两款模型激活参数均为 17B,分别具备约 400B 和 109B 总参数,基于 40 万亿 token 训练,Instruct 版本分别支持 1M 与 10M 上下文。

    推荐理由:原文解析了 Llama 4 的混合专家架构与长上下文机制,并给出了 Hugging Face 生态的调用代码与量化部署支持。

4月4日周五
  1. Hugging Face Blog64

    Gradio 月活跃开发者突破 100 万:开源库增长的五大核心经验

    Gradio 宣布月活跃开发者突破 100 万,并总结了从斯坦福研究工具发展为头部机器学习 Web 框架的五项经验。团队强调应投资底层基础组件而非高层抽象、将裂变能力嵌入库本身、专注机器学习细分垂直场景,并以快速迭代替代固定路线图。目前 gr.Blocks 占其总用量的 80%,应用启动时还会同步生成 API 端点,未来还将支持通过 MCP 被 AI 智能体直接调用。

    推荐理由:团队总结了打造百万月活开源工具的五条核心策略,对开发开源框架和设计开发者工具有直接参考价值。

4月3日周四
  1. Hugging Face Blog73

    Hugging Face 宣布将其 NLP 课程升级更名为 LLM 课程

    Hugging Face 宣布将运营三年的经典 NLP 课程全面升级并更名为“LLM 课程”,以纳入大语言模型微调以及构建 DeepSeek-R1 类推理模型等前沿技术内容。原有文本分类、命名实体识别等经典模块将继续保留并引入 ModernBert 等新技术进行更新;新章节还将与 Unsloth、LangChain、LlamaIndex 等开源工具深度合作,提供涵盖微调、推理与检索的实践内容。

    推荐理由:Hugging Face 将经典自然语言处理课程升级为大语言模型课程,涵盖微调与推理模型开发并整合了更多开源生态工具。

3月27日周四
  1. Hugging Face Blog82

    Hugging Face Open R1 第 4 期更新:DeepSeek-V3 0324 解析与部署指南

    Hugging Face 发布 Open R1 项目第 4 期更新,系统解读了静默上线 Hub 的 DeepSeek-V3 0324 模型特性。该版本改用 MIT 许可协议,在 AIME(从 39.6 升至 59.4)和 GPQA 等基准测试中大幅提升,并优化了前端代码与中文写作。

    推荐理由:原文整理了新版 DeepSeek-V3 的基准提升幅度与协议变更,并给出从 API 到本地量化部署的具体运行方案。

3月20日周四
  1. Hugging Face Blog66

    Open R1:如何在本地部署并使用 OlympicCoder 进行编程

    Hugging Face 介绍了在本地开发环境中部署与运行 OlympicCoder 7B 编程模型的方法。用户可以通过 LM Studio 运行 Q4_K_M 等 GGUF 量化版本并开启本地服务接口,再借助 VS Code 插件 Continue 完成接入,实现代码补全、生成、解释与重构。

    推荐理由:原文提供了将开源竞赛编程模型本地化接入开发环境的完整步骤,适合开发者据此搭建离线可用的代码辅助工作流。

3月18日周二
  1. Hugging Face Blog79

    NVIDIA 在 GTC 2025 发布物理 AI 开源模型与数据集:Cosmos Transfer、GR00T N1 与 15TB 训练数据

    NVIDIA 在 GTC 2025 推出面向物理 AI 开发的开源资源套件,包括 7B 参数的多控制世界模型 Cosmos Transfer、通用人形机器人基础模型 Isaac GR00T-N1-2B,以及包含超 32 万条轨迹的 15TB 物理 AI 数据集。

    推荐理由:提供了从世界生成模型、通用人形本体控制到大规模仿真数据的完整开源方案,有助于具身智能开发者直接复用并微调下游任务。

3月12日周三
  1. Hugging Face Blog75

    Open R1 发布第 3 期进展:开源 OlympicCoder 代码推理模型与 IOI 评测基准

    Hugging Face 发布 Open R1 项目第三期进展,推出基于 DeepSeek-R1 蒸馏的 OlympicCoder-7B 与 32B 代码模型,并开源 IOI 评测基准及近 10 万条 CodeForces-CoTs 数据集。

    推荐理由:团队不仅开源了针对竞赛编程的代码推理模型与评测集,还总结了长思维链微调中样本打包等关键工程避坑经验。

3月11日周二
3月7日周五
3月4日周二
  1. Hugging Face Blog69

    Aya Vision 深度解析:推进 23 种语言的多语言多模态模型前沿

    Cohere For AI 正式开源 Aya Vision 8B 与 32B 多语言视觉语言模型,覆盖 23 种语言并在 AyaVisionBench 等评测中展现出超越同尺寸甚至更大模型的表现。

    推荐理由:文章公开了合成标注扩充多语言数据与多模态模型融合的技术配方,为中小参数视觉语言模型在跨语言场景下的优化提供了可迁移方案。

2月25日周二
  1. Hugging Face Blog76

    Hugging Face 推出 FastRTC 实时音视频通信库

    Hugging Face 推出 FastRTC,这是一个专为 Python 设计的实时音视频通信库,旨在降低实时 AI 应用的开发门槛。该库内置自动语音活动检测与轮流发言控制,支持 WebRTC 与 WebSocket,可自动生成 Gradio 交互界面或单行挂载至生产级 FastAPI 服务。

    推荐理由:该库简化了 Python 实时音视频应用的开发流程,开发者可以直接复用其内置的语音检测与传输能力构建交互应用。

2月14日周五
  1. Hugging Face Blog69

    Hugging Face 使用 Math-Verify 修复 Open LLM 榜单数学评测并重跑全部模型

    Hugging Face 宣布在 Open LLM Leaderboard 中引入 Math-Verify 验证工具,彻底重新评测了此前提交的全部 3,751 款大语言模型,解决了旧评测流程因格式匹配脆弱和 SymPy 符号解析缺陷导致的误判低估问题。

    推荐理由:原文展示了因答案提取和符号解析缺陷导致的评分失真,为大模型数学评测实践和榜单排名修正提供了具体参考。

2月12日周三
  1. Hugging Face Blog62

    Hugging Face 详解如何构建高质量视频生成数据集

    Hugging Face 团队开源了一套面向小规模视频生成模型微调的数据集构建管线与脚本工具,涵盖视频获取、质量过滤与多模态标注三个阶段。管线通过 yt-dlp 分割镜头,利用 LAION 水印检测、美学评分模型及 OpenCV 运动评分完成过滤,并接入 Florence-2 或 Qwen2VL 生成文本描述。

    推荐理由:文章拆解了视频生成数据集从镜头切分、水印与美学过滤到打标的三阶段管线,为微调视频模型的开发者提供了具体的参数取舍经验。

2月11日周二
  1. Hugging Face Blog74

    Hugging Face 发布 Open R1 第二期进展:推出数学推理数据集 OpenR1-Math-220k

    Hugging Face 发布 Open R1 项目第二期更新,正式推出包含 22 万道题目验证推理轨迹的数学推理数据集 OpenR1-Math-220k。

    推荐理由:文章公开了用本地集群复现高质量数学推理数据的完整过滤流水线与吞吐方案,为开发者构建领域蒸馏数据提供了可复现的工程参考。

2月4日周二
  1. Hugging Face Blog71

    Hugging Face LeRobot 正式支持机器人基础模型 π0 与 π0-FAST

    Hugging Face 宣布将 Physical Intelligence 开发的机器人基础模型 π0 与 π0-FAST 移植到 LeRobot 开源生态中,并提供了 PyTorch 版本实现。

    推荐理由:文章详解了 VLA 模型的块稀疏注意力优化与动作分词方案,为具身智能开发者在 PyTorch 生态部署机器人策略提供了工程参考。