OpenAI 微调 API 引入视觉能力,支持微调 GPT-4o
OpenAI 宣布在微调 API 中正式引入视觉支持。开发者现可结合图像和文本数据微调 GPT-4o,以针对特定场景提升模型的视觉能力。
推荐理由:开发者可基于自身的图文数据集定制 GPT-4o,有助于优化特定场景下的视觉理解表现。
公司与模型
OpenAI 的全部动态:GPT 系列模型、ChatGPT 与 Sora 产品、公司战略与人事的持续追踪。
54 条精选近 30 天 14 条共收录 216 条
OpenAI 宣布在微调 API 中正式引入视觉支持。开发者现可结合图像和文本数据微调 GPT-4o,以针对特定场景提升模型的视觉能力。
推荐理由:开发者可基于自身的图文数据集定制 GPT-4o,有助于优化特定场景下的视觉理解表现。
OpenAI 在 API 中推出提示词缓存(Prompt Caching)功能。该功能可对模型最近已处理过的输入内容自动提供折扣优惠。
OpenAI 在其 API 平台上线模型蒸馏功能。开发者可以直接在 OpenAI 平台上,使用前沿大模型的输出结果来微调成本效益更高的小模型。
推荐理由:开发者可以直接在 OpenAI 平台利用前沿大模型的输出微调低成本小模型,简化了蒸馏落地流程。
OpenAI 封禁了疑似属于与伊朗相关黑客组织 CyberAv3ngers 的账号。调查发现,相关账号利用 AI 技术研究工业控制系统、默认凭据以及潜在攻击目标。
推荐理由:原文通报了针对工业控制系统等目标的恶意利用行为与处置,读者可据此了解大模型在网络侦察中的潜在风险。
OpenAI 宣布推出 OpenAI o1 模型。当前抓取材料仅包含发布标题,未提供详细技术说明与正文内容。
OpenAI 推出 o1-mini 模型,主打推进具备高成本效益的推理能力。
OpenAI 宣布使用 GPT-4 自动编写大语言模型中神经元行为的解释并对解释进行打分。同时,官方公开发布了针对 GPT-2 每个神经元的解释与评分数据集。
推荐理由:OpenAI 尝试用 GPT-4 自动化解释和评估网络内部神经元,为利用大模型开展可解释性研究提供了具体落地思路。
OpenAI 训练并推出了对话模型 ChatGPT,该模型采用对话形式与用户交互。对话格式使其能够回答后续追问、承认自身错误、质疑不正确的前提,并拒绝不合理的请求。
推荐理由:官方介绍了对话交互机制的核心特性,读者可以了解模型在处理追问、承认错误与拒绝不当请求上的交互设计。
OpenAI 宣布 DALL·E 正式取消候补名单限制,新用户无需排队即可直接开始创作。官方表示,实际部署中积累的经验以及安全系统的改进使得更大范围的开放成为可能。
OpenAI 为 DALL·E 推出 Outpainting 功能。该功能允许用户在原有画面基础上向外延伸扩展,生成任意尺寸的图像以展现更宏大的视觉内容。
OpenAI 研究表明 CNN、ResNet 和 Transformer 架构中普遍存在双重下降现象,模型性能随着模型尺寸、数据量或训练时间的增加,会呈现先提升、后恶化、再重新提升的变化趋势。该效应通常可通过精细的正则化手段来避免。团队指出这一现象虽然普遍存在,但底层机制尚未完全明确,仍是重要的研究方向。
推荐理由:原文展示了模型规模与泛化性能之间非单调变化的规律,为理解深度学习训练机制与正则化调优提供了理论参考。
OpenAI 宣布其由五个神经网络组成的 AI 团队 OpenAI Five 已开始在 Dota 2 比赛中击败业余人类战队。
OpenAI 发布关于 AI 与算力的分析指出,自 2012 年以来最大 AI 训练运行所使用的算力呈指数级增长,翻倍周期约为 3.4 个月。相比摩尔定律 2 年的翻倍周期,该指标自 2012 年起已增长超过 300,000 倍,而 2 年翻倍仅能带来 7 倍增幅。OpenAI 表示算力提升是 AI 进步的关键动力,行业需为能力远超当前水平的系统做好准备。
推荐理由:该分析量化了训练算力以 3.4 个月为周期的翻倍速度,为理解前沿模型演进提供了基准参照。
OpenAI 宣布作为一家非营利人工智能研究机构成立,其核心目标是在不受财务回报约束的前提下推进数字智能,从而造福全人类。该机构表示,摆脱财务义务能让其研究团队更专注于对人类产生积极影响。
推荐理由:原文说明了机构创立初期的非营利属性,有助于读者了解其摆脱财务约束以专注人类福祉的背景设定。