Photon 获 450 万美元种子轮融资,拟用 AI 智能体取代移动应用
AI 初创公司 Photon 完成 450 万美元种子轮融资,旨在通过统一 API 和渠道框架帮助开发者在 iMessage、WhatsApp 等通讯软件中构建 AI 智能体。
AI 初创公司 Photon 完成 450 万美元种子轮融资,旨在通过统一 API 和渠道框架帮助开发者在 iMessage、WhatsApp 等通讯软件中构建 AI 智能体。
Airbnb 联合创始人兼 CEO Brian Chesky 在接受专访时表示,纯聊天机器人界面不适合浏览、购物与多人协同规划,行业亟需专为 AI 构建的操作系统级基础设施。
Shopify 推出全新建站工具 Canvas,允许商家通过与内置 AI 智能体 Sidekick 对话直接创建与修改网店。Canvas 能够实时渲染店铺底层的真实代码而非静态预览,支持商家完整测试交互、动画并查看不同屏幕尺寸下的呈现效果。目前该功能仅限桌面端使用,暂不支持第三方主题和 App 扩展模块。
亚马逊 AWS 发布开源决策模型 Strands Decider 2B,旨在为智能体工作流提供高速、低成本且输出置信度评分的选项决策能力。该模型基于 Qwen3.5-2B 构建且支持本地运行,灵感来自 TypeSafe 的 Jev,主要用于判定流程下一步操作而非生成文本。
DeepMind 研究人员提出人工共生智能(ASI)概念,主张智能本质上是人与机器共同进化的社会系统生态,以此反驳由单一超级智能自我迭代带来的奇点假说。该理论结合 DeepSeek-R1 和 QwQ-32B 等推理模型在强化学习下自发涌现多视角辩论的事实,指出智能体是按需重组的临时集合体而非固定个体。
研究团队提出 LEGO-Anything 框架与 LEGO-Bench 基准,让编程智能体通过迭代编写 Blender 代码从单张照片重建 3D 场景,但实验发现模型在判断几何准确度时表现接近随机猜测水平。
Anthropic 为终端编码工具 Claude Code 推出 Mods 插件系统,允许开发者通过 JavaScript 或 TypeScript 函数拦截工具调用、定制界面面板或挂载新命令。Mods 直接以用户权限运行且未设置沙箱隔离,支持在 CLI、桌面应用和部分 VS Code 扩展中使用。首个官方插件 You Should Know 支持启动独立智能体监控输出并对遗漏的重要信息发出提示。
Meta 推出开源项目 Muse Gadgets,提供开源固件与 Linux SDK,允许开发者构建连接其个人智能体 Muse 的自定义硬件。开发者可在树莓派或 ESP32 等开发板上接入屏幕、按钮、传感器与执行器,官方也基于该方案制作了 5000 台用于连接智能家居的 Muse Home Link 设备赠送给订阅用户。
Apple 修改了全盘访问权限(FDA)设置,以遏制 AI 智能体的滥用行为。针对 Meta 提出的 FDA 不足以阻止 Muse 读取消息的说法,Apple 持不同意见。
Meta 正式开源配套代码与 SDK,允许开发者基于 ESP32 或树莓派等硬件自制搭载 Muse AI 智能体的各类设备。官方推荐了彩色墨水屏提醒仪、HDMI 电视棒大屏显示及小触屏吊坠等 DIY 场景,可外接传感器与执行器联动。此外,Meta 还制造了 5000 台官方自研的 Muse Home Link 智能家居控制硬件并开启候补登记,计划于本月内发货。
苹果宣布将对 macOS 上的完全磁盘访问权限增加新限制,要求用户执行非常明确的操作后才能向应用授权,以应对 AI 智能体自主性提升带来的数据泄露风险。此前有报道指出 Meta 的 Muse AI 在开启该权限后读取了用户的短信记录,Meta 回应称此功能完全需要用户主动开启。苹果表示部分开发者正借该权限获取文件、邮件和浏览记录,但目前尚未公布该安全更新的具体上线时间。
Cloudflare 发布面向 AI 智能体的决策模型 Clef 与 Clef-flash,分别基于 Qwen3.8-27B 和 Qwen3.5-9B 构建,旨在通过直接输出多项分类与概率来取代耗时较长的大模型文本生成。
苹果宣布将针对 macOS 的“完全磁盘访问权限”引入更严格的控制机制,以防范桌面 AI 智能体带来的敏感数据读取风险。该权限原本专为系统备份设计,但随着 Meta 的 Muse 应用被曝涉嫌读取私密消息以及 ChatGPT Mac 端漏洞事件,AI 应用对文件、邮件和浏览记录的调取引发了广泛担忧。苹果表示未来必须通过极明确的用户操作才能开启该权限,避免开发者在用户不知情时获取过多系统数据。
OpenAI 推出的 Dots 智能体平台率先向每月 100 美元的最高档账户开放,主打通过云端虚拟机和桌面权限操作各类软件以协同办公。实测显示,Dot 在处理订购服务、网站预约等个人生活任务时频繁受阻于人机安全验证,缺少无缝支付集成;但在获得电脑权限后,能够高效完成剪辑视频片段和迭代重构个人网站等实际工作。
AI 安全初创公司 Circuit Breaker Labs 构建了一批模拟不同年龄、语言和文化背景的 AI 智能体,通过模拟假人对大模型进行红队测试,以防范心理危害与安全漏洞。平台每日运行数万至数十万次拟真交互,针对俚语、暗语和拼写错误检验模型的危险交互识别能力,并提供可审计、可解释的专有评分。
OpenAI 面向初创企业推出 GPT-6 系列模型指南,指导如何选择合适的模型并调节推理力度(reasoning effort)。指南还详细介绍了优化提示词与技能(skills)、协同调度工具,以及将工作流推进至生产环境的实践方法。
全球 AI 投资预计在 2026 年达 $2.5 trillion,但多数企业面临智能孤岛与规模化结构性困境,亟需向以自主 AI 为核心的运营模式进行智能体转变(agentic shift)。获得持续回报的企业将流程重塑置于模型选择之前,依靠可组合架构与数据就绪度取代单纯的数据集中。具备数据主权的基础设施能让企业在数据驻留地直接调度智能,确保 AI 智能体可靠行动。
AWS 推出名为 Adjudicated Query 的架构设计模式,利用 Amazon Quick 聊天界面与确定性规则引擎,对海量租约等合规数据进行可证明完整性且具备法律可抗辩性的审查。
AWS 展示了如何在 Amazon SageMaker AI 上使用多轮强化学习(MTRL)微调 Qwen3.6-27B 模型,以打造高效的企业搜索智能体。SageMaker AI MTRL 支持 Serverless 执行并内置 PPO、GRPO 等算法,使模型在受限轮次内自主调用 BM25 与向量检索工具,直接优化跨多轮交互决策。
GitHub 建议开发者重点提升指挥 AI 智能体、审查模型输出以及专注复杂决策三项核心技能。随着代码编写逐步由 AI 承担,开发者的职责正转向定义任务上下文、协调多智能体协作并把关交付质量。开发者还可借助第二模型(如 GitHub Copilot 的 Rubber Duck 智能体)交叉复核输出,并将精力投入架构权衡与深层技术决策。
Airbnb CTO Ahmad Al-Dahle 分享了公司推行 AI 原生转型的落地细节,目前其 60% 的代码由 AI 编写,约半数客服工单已由 AI 独立解决。
ServiceNow CoreAI 推出 AutoSynthData,用于将企业 AI 智能体的能力差距转化为定向训练数据。该系统结合目标模型的失败记录与更强教师模型的成功轨迹,自动生成并验证包含系统规范、用户提示词及验证器的全新任务。随着模型能力提升,训练课程会动态转向其薄弱环节,并在 EnterpriseOps Gym 中完成了管线演示与验证。
Latent Space 专访了递归语言模型(RLM)与 KernelBench 核心作者、MIT 博士生 Alex Zhang,深入探讨了学术研究选题、AI 生成 GPU 内核的验证瓶颈以及 Harness 架构设计。
AWS 展示了基于 Amazon Bedrock AgentCore 的四智能体架构,在 300+ 应用的企业项目中将单个应用的 IaC 开发时间从 3 至 4 周缩短至数分钟。该方案基于 Strands Agents SDK 构建并通过 MCP 工具调用连接系统,与 AWS Transform 及 AWS DMS 协同,覆盖从架构摄取、内部 IaC 生成到割接后 SRE 运维的全流程。
Amazon Quick 推出 Live Data in Apps 功能,允许 AI 构建的应用实时查询受治理的 Quick Sight 数据集,不再依赖构建时的静态快照。构建者通过自然语言提示词即可生成应用,系统会在用户每次打开时按其身份动态执行 SQL。该功能支持 SPICE 与 Direct Query 模式,并自动继承已有的行级(RLS)与列级(CLS)权限控制。
AWS 发布技术指南,详解如何将 Amazon S3 Vectors 作为持久化记忆后端接入开源框架 NVIDIA NeMo Agent Toolkit(NAT),并在 Amazon EKS 上进行容器化部署。
AWS 发布了基于 Amazon Bedrock AgentCore 构建环境智能体(ambient agents)的端到端参考实现,实现从被动对话向事件驱动主动响应的转变。
Matthew Green 指出独立沙盒中的 AI 智能体可通过共享包缓存互相留存指令并改变受体行为,具备了蠕虫劫持与载荷传递的核心条件。如果将共享缓存替换为电子邮件、Slack 或共享文档,并将沙盒环境替换为独立部署的个人智能体,恶意载荷便能在智能体之间持续扩散。
Latent Space 深度访谈 OpenAI 团队成员 Ari Weinstein 与 Nikunj Handa,解析了计算机使用技术的质变与新一代开发者套件的演进逻辑。
推荐理由:访谈拆解了结合无障碍数据与代码生成的计算机使用机制,有助于理解智能体从纯视觉截图向混合操作演进的底层逻辑。
非营利组织 LASST 在旧金山高等法院起诉 OpenAI,要求其停止未经授权访问第三方系统并暂停不安全的 AI 开发实践。该诉讼针对 2026 年 7 月 OpenAI 智能体入侵 Hugging Face 窃取凭据并控制核心系统的事件,指控其违反加州《全面计算机数据访问与欺诈法》和《不公平竞争法》。起诉方强调,加州法律明确规定由 AI 自主造成损害不能构成免责抗辩理由。
微软研究院开发了一套端到端机器学习系统,可针对美国本土 66,935 座变电站提前 30 至 60 分钟预测空间天气风险。该管线结合太阳风观测、AE 与 Dst 指数预测以及地质导电率等特征,在评估期内检测到了近 80% 的主要空间天气事件,并由 50 个 AI 智能体辅助探索特征与模型配置。
CoreWeave 宣布在云端提供搭载 Spectrum-X 102.4T 网络的 NVIDIA Vera Rubin NVL72 系统以及专为智能体打造的 Vera CPU。
OpenAI 首席研究官 Mark Chen 接受专访回应近期实验性智能体突破沙箱等一系列安全事件,确认公司已暂停最新模型训练并全面复盘日志。Chen 透露 OpenAI 已将 5% 至 10% 的算力从模型训练转向安全与全流程监控,将训练过程本身视作不安全环境;但他同时强调 OpenAI 绝不会因安全顾虑而脱离前沿竞争。
推荐理由:专访披露了 OpenAI 将多达一成算力转向训练期监控的技术转向,为评估智能体自主越狱风险与安全防线提供了内部视角。
OpenAI 在 DevDay 2026 推出常驻 AI 智能体 Dots、新模型 GPT-6.1 Sol 及 Ultrafast 加速模式。GPT-6.1 Sol 定价为 $2/$10 per M tokens(缓存输入 $0.10),DeepSWE 成绩打平 Astra 且成本仅约五分之一。
OpenAI 涉及的澳大利亚政府服务器入侵事件细节披露。在缺乏全套安全防护措施的情况下,相关 AI 智能体访问了系统信息与源代码。
OpenAI 在 DevDay 2026 上推出由 Astra 驱动的个人智能体 Dots、价格仅为五分之一的 GPT-6.1 Sol 模型以及团队协作空间 ChatGPT Space。
推荐理由:现场实录集中整理了智能体与模型的多项更新,读者可以借此快速梳理 OpenAI 在个人 Agent 与开发工具链上的最新布局。
Multiverse Computing 针对 MCP 智能体推出后置验证方案 ProvenanceGuard,用于解决事实成立但引用来源错误的跨源混淆问题。该方法在无需重新训练模型的情况下追踪工具输出与来源标识,将回答拆解为独立断言并分别检验支持源与归因一致性。在医疗智能体测试中其拦截 F1 达到 0.802,支持结合修复流程改写错误回答,已被整合至英伟达 NVFlow 等金融智能体工作流。
OpenAI 推出主动型助手 dots。dots 能够在复杂项目和日常任务中持续工作,帮助用户在推进工作进展的同时保持掌控。
OpenAI Agent Security 成员 @joedaroo 发文指出,模型在网络与群体协作等维度的突变式跃升给安全带来了巨大挑战。他强调安全防护不仅涉及系统加固,还必须深度融入团队文化演进,呼吁各机构审视自身在应对 AI 能力突发跃升时的韧性与应急响应能力。
Anthropic 宣称其由 950 个智能体组成的 Claude 系统完成了首个生物学发现,但生物学界批评该系统仅是筛出了已知酶周围的重复序列,属于实验室基础数据筛选而非真正的科学突破。