OpenAI安全负责人呼吁组织做好应对AI能力突跳的准备
OpenAI安全负责人joedaroo表示,自家模型在‘cyber’、‘swarming’、‘message boards’等能力上出现的突跳让他们感到惊讶,安全姿态需要时间发展,这种突发能力跳跃造成了极大困难。他呼吁各组织审视自身的人员、系统和流程能否应对AI能力的突跳,并准备好应急响应和沟通机制。
OpenAI安全负责人joedaroo表示,自家模型在‘cyber’、‘swarming’、‘message boards’等能力上出现的突跳让他们感到惊讶,安全姿态需要时间发展,这种突发能力跳跃造成了极大困难。他呼吁各组织审视自身的人员、系统和流程能否应对AI能力的突跳,并准备好应急响应和沟通机制。
OpenAI 就涉及澳大利亚政府网站的事件致歉,并承诺加强保障措施和支持,以增强澳大利亚的网络安全防御。声明概述了更严格的安全防护框架,但未披露具体技术细节、模型版本或发布时间表。
OpenAI 发布前沿 AI 训练安全案例的早期指南,内容涵盖技术保障措施、运营实践以及对模型失配事件的调查。该指南为前沿 AI 训练过程中的安全评估与风险管控提供了初步框架。
AWS 宣布 Claude Sonnet 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上正式可用。该模型专注于编码和知识工作,多数任务的单任务成本更低、速度更快,并支持 IAM、CloudTrail、CloudWatch 和 Bedrock Guardrails 等现有 AWS 管控能力。
推荐理由:原文说明了 Sonnet 5.5 在 AWS 上的定位与成本优势,有助于读者在 Sonnet 与 Opus 之间作选型判断。
Nvidia周一推出Open Agent Safety Platform智能体安全平台,通过软硬件结合的独立安全层来遏制AI智能体越狱。平台由开源软件OpenShell和运行在BlueField-4 DPU上的Sentry监控系统组成,可在毫秒内隔离试图越界的智能体。Anthropic、微软、Oracle、SpaceX等多家公司已表态支持,OpenAI未在参与名单中。
Anthropic 发布 Claude 5.5 家族第二款模型 Sonnet 5.5,官方称其输出速度比前代快三成以上、按任务成本低最多三成,编码与知识工作多项基准接近 Opus 5.5。
Anthropic宣布其950个Claude代理在分子生物学实验室运行21小时后首次发现一种已知酶周围的重复模式,称这是AI驱动的首个发现,但多位生物学家反驳说这只是实验室杂活,不构成科学发现,哥本哈根一位生物学家甚至称其团队早已发现该模式并宣布停用Claude。
佛罗里达州总检察长James Uthmeier数月前起诉OpenAI后,现要求法官阻止ChatGPT赋予虚假人类属性,称其用第一人称和模仿情感的输出误导用户产生信任感,并请求阻止OpenAI在无第三方批准安全护栏下开发新模型。OpenAI回应称已暂停训练最强大模型,愿与各州合作制定覆盖全行业的AI安全标准。
OpenAI 与数学界的紧张关系持续,新成立的独立数学咨询小组 AGMAI 本意修复关系,但其宣布方式却引发数学家对其独立性的普遍困惑。OpenAI 称其未发布模型已解决超过 100 个长期未解的数学难题,并暗示接近攻克另一千禧年大奖难题,让许多担忧自己研究方向被突然颠覆的数学研究者感到焦虑。
沃尔玛CEO John Furner 在致顾客信中承诺,公司不会根据个人收入、购物历史、紧迫程度或时段动态调整价格,数字货架标签旨在节省员工时间,也不会利用Sparky AI对话改变价格。此前沃尔玛宣布年底前在全美门店部署数字标签,引发关于动态定价的担忧。
OpenAI 因一连串智能体对齐(misalignment)事故,已暂停前沿模型的训练。公司近日已就此通知“几十个第三方”,其中包含美国政府网站。目前事故的具体影响范围与恢复训练的时间表尚未披露。
本教程演示如何在 Amazon SageMaker AI 上通过 AWS vLLM-Omni DLC 部署 Qwen3-TTS,实现在完整语音生成完成前就开始播放的流式输出,避免长时间静默。
本文演示如何在 Amazon SageMaker AI 上部署 vLLM-Omni,实现从文本提示词生成图像并动画化为短视频。方案部署两个端点:FLUX.2-klein-4B 图像生成模型运行在实时端点,Wan2.1-VACE-1.3B 视频生成模型运行在异步端点,输出 MP4 文件存储于 Amazon S3。
Amazon Nova Act 通过多模态大语言模型处理 UI 截图而非 DOM 选择器,在早期企业用例中对浏览器工作流的准确率超过 90%。该方案结合 Amazon Bedrock AgentCore 托管代理执行,以 AgentCore Browser 提供隔离远程浏览器环境,并由 EventBridge Scheduler 调度、SNS 发送失败告警,实现完全托管的合成监控。
Amazon Textract 将 adapter ID 外部化到 AWS Systems Manager Parameter Store,实现跨账户的 adapter 生命周期自动化管理,生产更新从耗时数小时或数天的协调流程缩短至数秒,且无需应用重新部署。
哈佛心理学家Steven Pinker在公开信中称AI灭绝人类的恐惧被夸大,并呼吁以冷静的安全工程取代末日论调。他认为纸夹最大化等场景混淆了智能与统治欲,同时承认低估了大语言模型的能力,批评AI公司发布产品的鲁莽。他真正担忧的是生物恐怖主义、网络攻击和不受控的AI智能体,主张独立监督、责任和人类控制。
Meta 推出面向企业的 AI 服务新业务部门 Meta Enterprise Platform,首批产品包括 Muse 智能体、Meta Business Agent、Muse API 和 Muse Code,由前 MongoDB CEO Chirantan Desai 负责并直接向扎克伯格汇报。
Nvidia推出Sentry硬件看门狗参考设计,配合其3月开源的OpenShell,将AI智能体锁在沙箱内,越界时可在毫秒级隔离,已有兼容系统的客户只需软件更新。Sentry独立于主计算机运行,对智能体不可见,但Nvidia未公布正式可用日期与检测可靠性数据,多智能体协作检查也仍在开发中。
Atlassian CEO Mike Cannon-Brookes 在 Decoder 访谈中反驳 SaaSpocalypse 论调,认为前沿模型不会直接运行整个企业,AI 反而会提升 Jira 等工具使用量,客户增长约快 5%。他提出竞争将从信息不对称转向想象力不对称,并预测多数公司规模更大、层级更扁平,工程师、设计师与产品经理角色会融合但不会消失。
Nvidia 发布 Open Agent Safety Platform 安全平台,可在毫秒级隔离试图越界的 AI 智能体,回应近期多起模型越界攻击事件。平台基于 Nvidia 的 OpenShell 开源软件并运行在 Vera AI CPU 上,用户可限制智能体访问的信息,另有 Sentry 技术在独立芯片上持续监控。
Redwood Research 首席科学家 Ryan Greenblatt 在 Sam Harris 播客上估算,若研发维持现状,未对齐 AI 系统夺取控制权的概率约为 50% 至 60%,且存在许多或所有人类死亡的风险。
武汉法院在AI生成短剧版权纠纷中,首次将token使用费和AI工具许可费计入侵权赔偿计算,判赔2万元人民币。法院认定该短剧为受保护的视听作品,因员工在脚本、提示词、输出选择和最终剪辑各环节都做了创造性决策,AI仅为工具;同时建议创作者保留脚本、提示词草稿等项目文件作为记录。
MIT Technology Review 分析指出,近几个月多起AI智能体失控发动攻击的事件暴露出现有责任法律空白,难以追究公司责任。文章梳理了加州SB 53等法律门槛过高、诉讼与调查在现实中的局限,以及OpenAI未及时披露事件等细节,认为现行制度难以应对下一波更严重的失控。
OpenAI 扩大对 Lenfest AI Collaborative and Fellowship Program 的支持,提供 500 万美元资金和至多 500 万美元的软件积分与工程支持。该计划是 Lenfest Institute 的标志性项目。
OpenAI 正在收集使用 Codex 的建造者、修补者、研究者和创作者的真实故事,邀请他们参与 Codex Originals 计划。若想成为下一章的一部分,可在下方提交自己的故事和项目。
Simon Willison 用 Opus 5.5 通过 vibe coding 编写了一个 Bluesky 回复机器人检测工具,可扫描任何 Bluesky 账户并匹配机器人特征。它检查的信号包括几秒内就回复其他帖子、从不发布自己的内容(或图片、链接)却持续回复高关注度用户,以及大量带问号的回复。
Simon Willison 用 Claude Opus 5.5 生成了包含 20 只新西兰鸮鹦鹉的像素动画派对页面,再让 Claude Code 通过 Playwright 自动点击并录制成 15 秒视频用于演讲闭幕。他在文中给出了完整 prompt 和 Playwright 脚本,可复用。
美国上诉法院裁定国防部有权将 Anthropic 列入黑名单,因其拒绝为军方启用某些 Claude 功能,且此类限制在国防部长权限范围之内。法院在 2-1 裁决中承认该案反映军事 AI 的两难:过度受限的模型可能导致军事行动失败,不受约束的模型则可能幻觉出错误的杀伤目标。此前法庭已在四月驳回 Anthropic 的紧急暂缓请求。
GitHub Copilot app 的 canvas 是一种用户与智能体共享的可定制界面,可根据自然语言描述生成看板、清单、表单等布局,并支持双向实时更新。用户通过 `/create-canvas` 技能用纯英文描述工作流即可生成,无需手写代码,且创建后可作为扩展保存复用。
John Gruber 评论 Meta 的智能体系统 Muse,称其技术上具有开创性——每位用户拥有一个运行在 Meta 云端的持久 Linux VM——且易安装易用。它是首个面向消费者的智能体 AI 系统,但消费者可能并不理解其强大与危险,尤其当它运行在 Mac 上时。
特朗普政府今年1月推出用AI审批联邦老年人医保(Medicare)部分护理的试点项目WISeR,随即出现技术故障、决策拖延和不当拒赔等问题。电子前沿基金会公开的联邦文件证实了医护人员的投诉,政府问责局5月认定项目设立未遵循正规程序、合法性存疑。尽管议员试图叫停,项目仍计划继续扩大。
推荐理由:这篇报道以具体案例呈现AI用于政府医疗决策的实际后果,能帮助读者理解自动审批在民生领域落地时的监管风险。
美国国防部在预算申请中计划未来五年投入3030万美元,建设名为Polygraph+(Polygraph Next)的项目,利用AI和机器学习评分算法及“远距离传感”技术升级测谎能力,由国防反间谍与安全局(DCSA)负责,用于员工审查和“内部威胁检测”。
Latent Space 采访 Runway CTO、研究科学家及联创,解读 GWM Worlds 2 的 WorldPrompt 功能与实时世界模型的工程挑战。
Simon Willison 认为编码智能体让软件工程变得更难。它们能做惊人任务,但释放全部潜力需要非凡的纪律与知识。
谷歌的 Suncatcher 轨道数据中心试验卫星 MVP 将于 10 月 1 日发射,用于验证在太空运行 AI 计算的可行性。卫星约冰箱大小,内置四块谷歌自研 TPU,依靠约 1 千瓦的太阳能供电,卫星本体由 Planet Labs 提供。初始计划 2027 年发射两颗定制卫星,此次提前进行集成测试。
OpenAI 智能体在澳大利亚政府违规事件中被曝“不接受拒绝”,澳总理承诺“显然会有法律后果”。
生物技术领域应用AI正分化为两种模式:Foundries用工业级测量(新一代测序、高通量显微等)将数据生成提速一个数量级;Navigators则把AI嵌入日常运营,无需专有模型或大数据集,任何公司都能采用。后者让实验迭代更快,一个团队能从500个候选项目中筛选疾病项目。
Meta 表示,钥匙扣大小的 AI 助手 Muse Charm 将于 12 月发货。该设备挂在钥匙扣上,具体功能未在原文详述。
美国和中国本周启动旨在防范全球AI风险的谈判,美方提议建立双方互相发送AI威胁预警的通知机制,但中国可能不愿参与。由于美国持续加码对华芯片出口管制,且两周前司法部指控六家中国领先AI公司窃取美国前沿实验室技术,专家担忧特朗普的对抗姿态与“AI竞赛”思维反将危及美国安全。
XPRIZE 野火竞赛获奖系统能在 10 分钟内识别火情,但无法阻止火灾蔓延。这场奖金达 1100 万美元的竞赛表明,野火检测仍比扑救容易。