跳到正文
  1. Hugging Face Blog62

    Ai2 开源科学文献报告生成模型 AstaBrief 8B

    Ai2 开源了基于 Qwen3-8B 打造的科学报告生成模型 AstaBrief 8B 及其训练数据与工作流,该模型已作为快速模式上线科学智能体平台 Asta。

    推荐理由:原文展示了用引文密度过滤搭配简单微调替代复杂强化学习的训练实践,为垂直领域报告生成提供了轻量高效的参考范式。

  2. NVIDIA Blog79

    NVIDIA GPU 如何加速 OpenAI 的 GPT-6 Astra Ultrafast

    OpenAI 的 GPT-6 Astra Ultrafast 正式在 API 以及符合条件的 ChatGPT Work 和 Codex 中上线,基于 NVIDIA Blackwell GPU 运行。该模式相比 Astra Standard 的 token 生成速度最高提升 8 倍,显著缩短了编码智能体在编辑、测试与调试循环以及工具调用之间的响应等待时间。

    推荐理由:文章介绍了基于硬件架构的推理优化细节,有助于读者评估生成加速对编码智能体与工具调用延迟的具体影响。

  1. Google DeepMind76

    Google DeepMind 发布前沿模型 Gemini 4 Argon

    Google DeepMind 宣布推出前沿模型 Gemini 4 Argon,将其单次输出 token 上限从 64K 提升至 1M,专用于长流程深度推理、软件工程与网络安全防御。

    推荐理由:该模型大幅提升输出长度上限并展示了真实工业代码迁移等长流程推理实践,读者可据此评估复杂智能体任务落地的可行边界。

  1. Hugging Face Blog69

    NVIDIA 发布表格基础模型 Kumo Tabular

    NVIDIA 推出开源表格基础模型 Kumo Tabular,支持在无需特征工程与微调的情况下通过单次前向传播完成分类与回归预测。该模型参数量在 28M 至 215M 之间,完全基于因果图生成的合成数据预训练,在 TabArena 等四个表格基准测试中均位居榜首。模型权重与代码库已通过 Hugging Face 和 GitHub 开放,采用 OpenMDW-1.1 许可证允许商用。

    推荐理由:模型展示了用上下文学习替代传统表格特征工程与调参的可行路径,对探索结构化数据基础模型的团队很有参考价值。

  2. OpenAI News73

    OpenAI 推出 GPT-6.1 Sol

    OpenAI 推出 GPT-6.1 Sol 模型,在编码、计算机使用及专业工作上具备接近 Astra 的智能水平。该模型的标准 API 输入和输出 token 价格仅为 Astra 的五分之一。

    推荐理由:该模型以 Astra 五分之一的 API 输入与输出 token 价格提供接近 Astra 的编码与计算机使用能力,直接降低了相关场景的调用成本。

  1. Hugging Face Blog77

    H公司发布通用计算机使用智能体模型 Holo4 系列与 Holotron4 Nano

    H公司发布专为通用计算机操作打造的 Holo4 智能体模型系列,包含 27B Dense 与 35B-A3B MoE 两种规格,并同步推出轻量级模型 Holotron4 Nano。

    推荐理由:展示了开源中等规模模型如何通过混合 GUI 与 API 接口调用,在桌面控制长流程任务中降低落地成本。

  1. Google DeepMind75

    Google 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 语音生成模型

    Google DeepMind 正式推出 Gemini 3.8 Flash TTS 与 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持通过自然语言提示词定制角色声音、30 秒音频克隆以及双角色逐行台词编排。

    推荐理由:模型通过自然语言提示词定制角色声音并支持双角色台词编排,为游戏、播客及有声书的长音频生成提供了细粒度表演控制方案。

  2. OpenAI News74

    OpenAI 推出 GPT-6 Sol 与 Luna 模型

    OpenAI 推出 GPT-6 Sol 和 GPT-6 Luna 两款新模型。两款模型在能力与成本之间提供不同的平衡,旨在将前沿智能引入日常工作中。

  1. Microsoft Research61

    微软在 Nature 发表小分子逆合成预测模型 RetroChimera 并开源代码与权重

    微软研究团队在《Nature》发表小分子逆合成预测框架 RetroChimera 并开源代码与权重,该模型可自动化推荐高质量化学合成路线。系统结合了基于 Transformer 的生成模型 R-SMILES 2 与基于图神经网络的模板模型 NeuralLoc,通过学习重排序机制融合两者的互补优势。

    推荐理由:通过结合生成模型与图神经网络模板的互补优势,该方法为解决复杂小分子逆合成中的长尾反应预测提供了可复现的集成路径。

  1. Google DeepMind82

    Google DeepMind 发布 Gemini 3.8 Live 与 3.8 Live Extended Thinking 实时对话模型

    Google DeepMind 推出 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两款实时对话模型,主打近实时推理与语音智能体能力。

    推荐理由:新模型将并发多步推理融入低延迟语音交互,为开发者构建支持后台工具调用的复杂语音智能体提供了实用基准。

  1. OpenAI News70

    OpenAI 在 API 中推出 GPT-Live-1 语音模型

    OpenAI 在 API 中推出 GPT-Live-1,提供更自然的全双工语音对话能力。该模型具备更强的指令遵循能力,并支持自定义声音和电话功能接入。

    推荐理由:该模型通过全双工对话与电话接入拓展了实时语音能力,便于开发者在 API 中构建定制化语音应用。

  1. Google DeepMind77

    Google DeepMind 推出全球气象 AI 模型 WeatherNext 3

    Google DeepMind 与 Google Research 正式发布全球气象 AI 模型 WeatherNext 3,支持实时卫星数据输入与小时级更新。

    推荐理由:原文对比了传统数值预报与前代模型在时效与精度上的差距,展示了利用实时卫星数据实现小时级高分辨率气象预测的技术路径。

已经到底了