跳到正文
10月2日周五
9月30日周三
  1. Hugging Face Blog65

    Hugging Face 推出 Open TTS Leaderboard:多语言与声音克隆语音评测榜单

    Hugging Face 推出 Open TTS Leaderboard,采用客观自动化指标对开源文本转语音(TTS)模型进行多语言性能、推理延迟与声音克隆维度的评测。

    推荐理由:榜单通过自动化客观指标替代耗时的人工盲测投票,为多语言与声音克隆模型的选型提供了可量化的参考。

9月29日周二
  1. Hugging Face Blog69

    NVIDIA 发布表格基础模型 Kumo Tabular

    NVIDIA 推出开源表格基础模型 Kumo Tabular,支持在无需特征工程与微调的情况下通过单次前向传播完成分类与回归预测。该模型参数量在 28M 至 215M 之间,完全基于因果图生成的合成数据预训练,在 TabArena 等四个表格基准测试中均位居榜首。模型权重与代码库已通过 Hugging Face 和 GitHub 开放,采用 OpenMDW-1.1 许可证允许商用。

    推荐理由:模型展示了用上下文学习替代传统表格特征工程与调参的可行路径,对探索结构化数据基础模型的团队很有参考价值。

9月28日周一
  1. Mistral AI48

    Mistral 在慕尼黑设立德国中心,推进工业与物理 AI 研发

    Mistral 宣布在德国慕尼黑设立新中心,重点开展物理 AI 与工业 AI 研发以服务当地企业。为保障欧洲 AI 主权,Mistral 计划到 2030 年建设 1 吉瓦欧洲算力,并以开放权重架构确保模型在客户本地基础设施上运行与审计。目前团队正与宝马合作碰撞模拟,并联合西门子能源及慕尼黑工业大学推进工业应用与数字孪生研究。

9月24日周四
  1. Hugging Face Blog45

    用 LFM2.5-VL-DSpark 加速视觉语言模型推理

    Liquid AI 发布用于视觉语言模型 LFM2.5-VL-3B 的投机解码草稿模型 LFM2.5-VL-DSpark。该模型仅增加 280M 参数(8.9%),在保持输出质量的同时,使端侧解码速度最高提升 3.13x(端到端提升 2.62x),H100 解码最高加速 2.66x。模型开源权重已在 Hugging Face 发布,首日支持 llama.cpp、MLX-VLM 与 SGLang。

9月22日周二
  1. NVIDIA Blog32

    从赋能到落地执行:埃及 AI 生态迈向生产级规模

    埃及 AI 生态正从技术赋能迈向生产级落地,其 NVIDIA 深度学习学员规模一年内增长超 10 倍。当地基础设施建设同步提速,Hassan Allam 与 A15 达成约 4 亿美元数据中心投资协议,Cassava 亦联合沃达丰埃及推进本地 AI 工厂落地。截至目前,NVIDIA 在非洲已培训超 8.5 万名开发者,持续支持本地化模型训练与推理部署。

9月21日周一
  1. Microsoft Research61

    微软在 Nature 发表小分子逆合成预测模型 RetroChimera 并开源代码与权重

    微软研究团队在《Nature》发表小分子逆合成预测框架 RetroChimera 并开源代码与权重,该模型可自动化推荐高质量化学合成路线。系统结合了基于 Transformer 的生成模型 R-SMILES 2 与基于图神经网络的模板模型 NeuralLoc,通过学习重排序机制融合两者的互补优势。

    推荐理由:通过结合生成模型与图神经网络模板的互补优势,该方法为解决复杂小分子逆合成中的长尾反应预测提供了可复现的集成路径。

9月16日周三
  1. Mistral AI60

    Mistral 与 Mozilla 达成合作,为 Firefox Smart Window 浏览器助手提供模型支持

    Mistral 宣布与 Mozilla 达成合作,由 Mistral 模型为 Firefox 的 AI 浏览助手 Smart Window(测试版)提供支持。该功能可协助用户理解复杂搜索、找回已关闭标签页的重要信息并整合标签页内容,目前面向法国和北美用户开放,英国和德国预计将在今年晚些时候跟进。

    推荐理由:原文披露了两家机构的技术合作细节与隐私承诺,读者可据此了解开源大模型落地主流浏览器的具体路径。

9月8日周二
9月1日周二
  1. Microsoft Research47

    GigaPath-Flash 与 GigaTIME-Flash:以高效病理基础模型迈向群体规模发现

    微软研究院开源了病理基础模型 GigaPath-Flash 与 GigaTIME-Flash(Apache 2.0 协议),大幅降低全切片图像分析的计算成本。其中 GigaPath-Flash 结合 22M 参数 ViT-S 块编码器与 21M 参数 LongNet 切片编码器,在 PANDA 与 EBRAINS 基准上计算量减少约 50 倍,性能保持在原版 3% 以内。

8月11日周二
  1. Mistral AI51

    Mistral推出区域推理端点与优先层,构建欧洲主权AI基础设施

    Mistral正式上线区域端点(Regional Endpoints)并开启优先层(Priority Tier)公测,支持客户自主选择在欧洲或美国运行推理,以满足数据驻留与合规要求。平台同时开始托管第三方开源模型(首发支持 Z.ai 的 GLM-5.2),并联合多家企业组建算力联盟,通过欧洲算力单元(ECUs)模式推进至2030年建设最高 1 GW 算力基础设施的长期计划。