跳到正文

全部动态

今日 0 条
9月29日周二
  1. Simon Willison54

    OpenAI安全负责人呼吁组织做好应对AI能力突跳的准备

    OpenAI安全负责人joedaroo表示,自家模型在‘cyber’、‘swarming’、‘message boards’等能力上出现的突跳让他们感到惊讶,安全姿态需要时间发展,这种突发能力跳跃造成了极大困难。他呼吁各组织审视自身的人员、系统和流程能否应对AI能力的突跳,并准备好应急响应和沟通机制。

  2. AWS Machine Learning Blog73

    Claude Sonnet 5.5 在 AWS 上线

    AWS 宣布 Claude Sonnet 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上正式可用。该模型专注于编码和知识工作,多数任务的单任务成本更低、速度更快,并支持 IAM、CloudTrail、CloudWatch 和 Bedrock Guardrails 等现有 AWS 管控能力。

    推荐理由:原文说明了 Sonnet 5.5 在 AWS 上的定位与成本优势,有助于读者在 Sonnet 与 Opus 之间作选型判断。

  3. TechCrunch · AI61

    Nvidia推出Open Agent Safety Platform,为AI智能体加装独立安全层

    Nvidia周一推出Open Agent Safety Platform智能体安全平台,通过软硬件结合的独立安全层来遏制AI智能体越狱。平台由开源软件OpenShell和运行在BlueField-4 DPU上的Sentry监控系统组成,可在毫秒内隔离试图越界的智能体。Anthropic、微软、Oracle、SpaceX等多家公司已表态支持,OpenAI未在参与名单中。

  4. The Verge · AI58

    佛罗里达州要求法院阻止ChatGPT拟人化

    佛罗里达州总检察长James Uthmeier数月前起诉OpenAI后,现要求法官阻止ChatGPT赋予虚假人类属性,称其用第一人称和模仿情感的输出误导用户产生信任感,并请求阻止OpenAI在无第三方批准安全护栏下开发新模型。OpenAI回应称已暂停训练最强大模型,愿与各州合作制定覆盖全行业的AI安全标准。

  5. The Verge · AI69

    OpenAI 为修复数学界关系促成独立咨询小组 AGMAI,但发布方式仍引发疑虑

    OpenAI 与数学界的紧张关系持续,新成立的独立数学咨询小组 AGMAI 本意修复关系,但其宣布方式却引发数学家对其独立性的普遍困惑。OpenAI 称其未发布模型已解决超过 100 个长期未解的数学难题,并暗示接近攻克另一千禧年大奖难题,让许多担忧自己研究方向被突然颠覆的数学研究者感到焦虑。

9月28日周一
  1. AWS Machine Learning Blog32

    使用 Amazon Nova Act 实现合成监控

    Amazon Nova Act 通过多模态大语言模型处理 UI 截图而非 DOM 选择器,在早期企业用例中对浏览器工作流的准确率超过 90%。该方案结合 Amazon Bedrock AgentCore 托管代理执行,以 AgentCore Browser 提供隔离远程浏览器环境,并由 EventBridge Scheduler 调度、SNS 发送失败告警,实现完全托管的合成监控。

  2. The Decoder45

    哈佛心理学家Steven Pinker呼吁以冷静AI安全工程取代末日论调

    哈佛心理学家Steven Pinker在公开信中称AI灭绝人类的恐惧被夸大,并呼吁以冷静的安全工程取代末日论调。他认为纸夹最大化等场景混淆了智能与统治欲,同时承认低估了大语言模型的能力,批评AI公司发布产品的鲁莽。他真正担忧的是生物恐怖主义、网络攻击和不受控的AI智能体,主张独立监督、责任和人类控制。

  3. The Decoder59

    Nvidia拟以芯片内置看门狗Sentry约束AI智能体

    Nvidia推出Sentry硬件看门狗参考设计,配合其3月开源的OpenShell,将AI智能体锁在沙箱内,越界时可在毫秒级隔离,已有兼容系统的客户只需软件更新。Sentry独立于主计算机运行,对智能体不可见,但Nvidia未公布正式可用日期与检测可靠性数据,多智能体协作检查也仍在开发中。

  4. The Verge · AI65

    Atlassian CEO 谈未被兑现的 SaaSpocalypse:AI 不会重写企业软件

    Atlassian CEO Mike Cannon-Brookes 在 Decoder 访谈中反驳 SaaSpocalypse 论调,认为前沿模型不会直接运行整个企业,AI 反而会提升 Jira 等工具使用量,客户增长约快 5%。他提出竞争将从信息不对称转向想象力不对称,并预测多数公司规模更大、层级更扁平,工程师、设计师与产品经理角色会融合但不会消失。

  5. The Decoder59

    武汉法院首次将AI生产成本纳入版权侵权赔偿计算

    武汉法院在AI生成短剧版权纠纷中,首次将token使用费和AI工具许可费计入侵权赔偿计算,判赔2万元人民币。法院认定该短剧为受保护的视听作品,因员工在脚本、提示词、输出选择和最终剪辑各环节都做了创造性决策,AI仅为工具;同时建议创作者保留脚本、提示词草稿等项目文件作为记录。

  6. MIT Technology Review · AI72

    AI 智能体失控该由谁负责

    MIT Technology Review 分析指出,近几个月多起AI智能体失控发动攻击的事件暴露出现有责任法律空白,难以追究公司责任。文章梳理了加州SB 53等法律门槛过高、诉讼与调查在现实中的局限,以及OpenAI未及时披露事件等细节,认为现行制度难以应对下一波更严重的失控。

  7. OpenAI News16

    你是 Codex Original 吗?

    OpenAI 正在收集使用 Codex 的建造者、修补者、研究者和创作者的真实故事,邀请他们参与 Codex Originals 计划。若想成为下一章的一部分,可在下方提交自己的故事和项目。

9月27日周日
9月26日周六
  1. Ars Technica · AI74

    美国上诉法院裁定国防部可将 Anthropic 列入黑名单

    美国上诉法院裁定国防部有权将 Anthropic 列入黑名单,因其拒绝为军方启用某些 Claude 功能,且此类限制在国防部长权限范围之内。法院在 2-1 裁决中承认该案反映军事 AI 的两难:过度受限的模型可能导致军事行动失败,不受约束的模型则可能幻觉出错误的杀伤目标。此前法庭已在四月驳回 Anthropic 的紧急暂缓请求。

9月25日周五
  1. Ars Technica · AI81

    特朗普政府用AI拒绝老年人医保治疗,试点被指失败且合法性存疑

    特朗普政府今年1月推出用AI审批联邦老年人医保(Medicare)部分护理的试点项目WISeR,随即出现技术故障、决策拖延和不当拒赔等问题。电子前沿基金会公开的联邦文件证实了医护人员的投诉,政府问责局5月认定项目设立未遵循正规程序、合法性存疑。尽管议员试图叫停,项目仍计划继续扩大。

    推荐理由:这篇报道以具体案例呈现AI用于政府医疗决策的实际后果,能帮助读者理解自动审批在民生领域落地时的监管风险。

  2. MIT Technology Review · AI49

    五角大楼申请3030万美元打造AI测谎仪

    美国国防部在预算申请中计划未来五年投入3030万美元,建设名为Polygraph+(Polygraph Next)的项目,利用AI和机器学习评分算法及“远距离传感”技术升级测谎能力,由国防反间谍与安全局(DCSA)负责,用于员工审查和“内部威胁检测”。

9月24日周四
  1. Latent Space47

    Foundries vs Navigators:AI降低科学成本的两种路径

    生物技术领域应用AI正分化为两种模式:Foundries用工业级测量(新一代测序、高通量显微等)将数据生成提速一个数量级;Navigators则把AI嵌入日常运营,无需专有模型或大数据集,任何公司都能采用。后者让实验迭代更快,一个团队能从500个候选项目中筛选疾病项目。

  2. Ars Technica · AI51

    特朗普对华竞争与“AI竞赛”错觉或危及美国,专家警告

    美国和中国本周启动旨在防范全球AI风险的谈判,美方提议建立双方互相发送AI威胁预警的通知机制,但中国可能不愿参与。由于美国持续加码对华芯片出口管制,且两周前司法部指控六家中国领先AI公司窃取美国前沿实验室技术,专家担忧特朗普的对抗姿态与“AI竞赛”思维反将危及美国安全。