跳到正文

#部署/工程

今日 0 条
9月29日周二
9月28日周一
  1. AWS Machine Learning Blog32

    使用 Amazon Nova Act 实现合成监控

    Amazon Nova Act 通过多模态大语言模型处理 UI 截图而非 DOM 选择器,在早期企业用例中对浏览器工作流的准确率超过 90%。该方案结合 Amazon Bedrock AgentCore 托管代理执行,以 AgentCore Browser 提供隔离远程浏览器环境,并由 EventBridge Scheduler 调度、SNS 发送失败告警,实现完全托管的合成监控。

9月24日周四
  1. AWS Machine Learning Blog41

    基于AWS的智能体对话式视频智能方案

    该方案在AWS上构建单一AI智能体,运行时按用户提问选择工具,对上传的视频返回自然语言答案。已分析内容的响应不到1秒,新视频初次分析需5–10分钟,代码已在GitHub开源。一家大型媒体娱乐公司采用后,对200多个多小时录音的手动审查时间减少约80%(未经独立验证)。

9月23日周三
9月22日周二
9月21日周一
  1. NVIDIA Blog38

    AI 安全是工程问题:NVIDIA 如何在智能体栈各层级解决

    NVIDIA 主张将 AI 安全作为工程问题处理,在智能体栈各层级落实安全要求、可控策略与责任归属,强调运行时环境须在智能体推理之外独立施加边界限制。NVIDIA OpenShell 提供开源安全运行时,在智能体能力之外强制策略并支持沙箱执行,Cisco DefenseClaw 与 JFrog 已基于其构建治理与技能扫描能力。

9月16日周三
  1. NVIDIA Blog60

    NVIDIA Vera Rubin NVL72 在 MLPerf Inference v6.1 首次亮相,吞吐量最高达 GB300 的 3.7 倍

    NVIDIA Vera Rubin NVL72 首次提交 MLPerf Inference v6.1 评测,在 Qwen3-VL 上吞吐量最高可达 GB300 NVL72 的 3.7 倍,在 DeepSeek-R1 上提升达 2.5 倍。GB300 NVL72 四机架扩展效率达 99%,软件优化较 v6.0 提升最高 1.6 倍。

    推荐理由:原文给出了 Vera Rubin 在 MLPerf 上相对 GB300 的具体吞吐提升倍数和扩展效率,读者可据此评估新一代平台在推理经济性上的实际价值。

9月15日周二
4月20日周一
  1. Berkeley AI Research40

    GRASP:面向更长视野世界模型的基于梯度的规划

    GRASP是一种新的基于梯度的规划器,用于学习动力学(世界模型),通过将轨迹提升为虚拟状态实现时间并行优化、直接向状态迭代添加随机性进行探索、重塑梯度以避免高维视觉模型中的脆弱梯度,从而让长视野规划变得实用。这项工作针对现代世界模型在长视野规划中的病态优化、非贪心局部极小和高维空间失效问题,提出了更鲁棒的梯度规划方法。