Meta 将 AI 智能体 Muse 扩展至小企业,接入 Shopify、Slack 等工具
Meta 本周二宣布将 AI 智能体 Muse 扩展到小企业,推出免费版 Muse for Small Business(带使用限制,可订阅升级),并新增 Shopify、Dropbox、Slack 等集成。
Meta 本周二宣布将 AI 智能体 Muse 扩展到小企业,推出免费版 Muse for Small Business(带使用限制,可订阅升级),并新增 Shopify、Dropbox、Slack 等集成。
前雅虎CEO玛莎·梅耶推出的个人AI助手Dazzle,通过分析用户手机相机胶卷来了解其爱好、兴趣和生活方式,并提供日程填充与个性化建议。该助手去年十二月完成800万美元种子轮融资,作者实测发现它能根据照片推荐度假地点,但也会遗忘已掌握的细节,例如用户女儿已会轮滑。
Manus 推出 2.0 版本,将智能体扩展为平台,支持视频编辑、多人游戏托管和通过手机远程运行个人智能体。新 Cascade 智能体架构在测试配置中 token 消耗减少 23.2%、成本降低 32%,桌面应用更名为 Manus Studio,独立应用 Cue 为每个智能体分配独立邮箱、钱包和云端计算机,现处于免费早期访问阶段。
推荐理由:原文给出了 Manus 2.0 的平台化能力扩展和效率数据,可以作为判断智能体产品形态变化的参考。
Thoughtful Things 为旗下首款乐器 Engram 发起 Kickstarter 众筹,这是一款利用 AI 搅碎输入音频、甚至凭空“幻觉”出全新声音的采样与律动工作站。它不联网,本地运行公司自研且定制训练的“微型 AI”,训练数据仅使用 CC-BY 等商业许可音频,并计划开放固件供用户加载自定义模型。众筹起步价 675 美元,约 30% 折扣,零售价预计在 850-900 美元之间。
Google宣布关闭Gemini的Gems功能,将其自动迁移为可供不同AI任务使用的“skills”,迁移自2026年11月17日起生效,用户无需任何操作。2024年推出的Gems此前支持用户构建学习教练、编程伙伴等自定义AI助手,迁移后用户需在任务线程中输入“/”来调用技能。
Anthropic 发布中端模型 Sonnet 5.5,官方称其速度比上一代快30%、token消耗更慢,并在智能体编码上表现优于 Opus 5.5。该模型首次适用与 Fable 和 Opus 相同的网络安全保障,公司还计划数周内推出小模型 Haiku 新版。
Grok 4.7 现已通过 Amazon Bedrock 上线,提供 500K token 上下文窗口和低、中、高、超高四档可配置推理力度。该模型面向编码、长时运行智能体和知识工作,支持 Responses、Chat Completions 和 Converse API。xAI 称其为最擅长编码和知识工作的模型,强调持久工作与自我校验。
推荐理由:Grok 4.7 登陆 Bedrock,文章梳理了 500K 上下文、四档推理级别与成本权衡,适合评估长任务智能体工作负载。
Shopify 宣布浏览器端 AI 智能体现在可在其商家网站完成购买,结账新增对 WebMCP 的支持,涵盖 Shop Pay。新工具 get_checkout、update_checkout、complete_checkout 让代理可检查结账、修改地址或配送方式并在买家授权后下单,无需依赖网页截图。Shopify 已与 Muse 及今日公布的 Instinct 达成智能体商业直接合作。
AWS 宣布 Claude Sonnet 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上正式可用。该模型专注于编码和知识工作,多数任务的单任务成本更低、速度更快,并支持 IAM、CloudTrail、CloudWatch 和 Bedrock Guardrails 等现有 AWS 管控能力。
推荐理由:原文说明了 Sonnet 5.5 在 AWS 上的定位与成本优势,有助于读者在 Sonnet 与 Opus 之间作选型判断。
Nvidia周一推出Open Agent Safety Platform智能体安全平台,通过软硬件结合的独立安全层来遏制AI智能体越狱。平台由开源软件OpenShell和运行在BlueField-4 DPU上的Sentry监控系统组成,可在毫秒内隔离试图越界的智能体。Anthropic、微软、Oracle、SpaceX等多家公司已表态支持,OpenAI未在参与名单中。
Nvidia推出Sentry硬件看门狗参考设计,配合其3月开源的OpenShell,将AI智能体锁在沙箱内,越界时可在毫秒级隔离,已有兼容系统的客户只需软件更新。Sentry独立于主计算机运行,对智能体不可见,但Nvidia未公布正式可用日期与检测可靠性数据,多智能体协作检查也仍在开发中。
Nvidia 发布 Open Agent Safety Platform 安全平台,可在毫秒级隔离试图越界的 AI 智能体,回应近期多起模型越界攻击事件。平台基于 Nvidia 的 OpenShell 开源软件并运行在 Vera AI CPU 上,用户可限制智能体访问的信息,另有 Sentry 技术在独立芯片上持续监控。
OpenAI 正在收集使用 Codex 的建造者、修补者、研究者和创作者的真实故事,邀请他们参与 Codex Originals 计划。若想成为下一章的一部分,可在下方提交自己的故事和项目。
谷歌的 Suncatcher 轨道数据中心试验卫星 MVP 将于 10 月 1 日发射,用于验证在太空运行 AI 计算的可行性。卫星约冰箱大小,内置四块谷歌自研 TPU,依靠约 1 千瓦的太阳能供电,卫星本体由 Planet Labs 提供。初始计划 2027 年发射两颗定制卫星,此次提前进行集成测试。
Meta 表示,钥匙扣大小的 AI 助手 Muse Charm 将于 12 月发货。该设备挂在钥匙扣上,具体功能未在原文详述。
YouTube在Made on YouTube活动上承诺今年晚些时候带来自定义信息流和更多AI功能。自定义信息流(Custom Feeds)可让用户通过描述生成新标签页,支持保存多个,先在美国的网页、移动和电视端推出;评论将支持GIF发布,私信也将新增群聊功能。
Google DeepMind 推出 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持用自然语言提示从零创建人物声音,并逐行控制台词演绎。
推荐理由:原文给出了自定义声音与逐行导演的具体入口和能力边界,读者可据此判断新模型如何改变配音和语音交互的工作流。
GPT-6 改进了提示词缓存,实现更高的缓存命中率,并新增诊断功能、显式断点以及降低延迟和成本的控制手段。
GPT-6 Sol 和 GPT-6 Luna 现已通过 Amazon Bedrock 正式可用,API 定价较 GPT-5.6 前辈显著降低。Sol 面向开发中的复杂重复任务,编码和计算机使用能力提升,内部评估事实错误约减半;Luna 面向高频任务,支持调整推理成本,两者均支持显式提示词缓存。
推荐理由:原文说明 GPT-6 Sol 与 Luna 在 Amazon Bedrock 上的正式可用性,并给出各自定位、更低的 API 定价与提示词缓存细节,可据此按任务成本选型。
Claude Opus 5.5 已在 Amazon Bedrock 和 Claude Platform on AWS 上线。相比 Opus 5,它用更少 token 完成任务且单价与缓存读取更便宜,平均单任务成本更低,并首次为 Opus 系列加入生物、网络安全和 AI 发展领域的安全分类器。模型支持自适应思考,可通过 Bedrock 控制台或相关 API 调用,覆盖多个地理区域的推理配置。
推荐理由:AWS 官方博客给出了 Opus 5.5 的效率与成本优势说明,并附 Bedrock 调用示例,便于开发者评估部署价值。
llm-anthropic 0.29 发布,这是 llm 工具的 Anthropic 插件版本更新。
Simon Willison 发布 llm-typesafe 0.1a0 插件,为他的 LLM 命令行工具接入 TypeSafe AI 的 Jev 模型。通过 llm install llm-typesafe 安装并设置 API key 后,可用 -m jev 指令完成 yes/no 的 noul 判断、choice 选择和 score 评分三类类型安全结构化输出。
NVIDIA 在加拿大多伦多 ROSCon 上发布 Isaac ROS 5.0,为约 130 万 ROS 用户带来 Agent 化开发工作流,并新增对 ROS Lyrical 和 Ubuntu 24.04 的支持。
NVIDIA 推出 DSX Ready 资格认证项目,面向满足 NVIDIA DSX AI 工厂参考设计要求的电源与冷却产品,首批涵盖电池储能系统(BESS)和冷却分配单元(CDU)。
Higgsfield AI 借助 GPT-6 Astra 在一天内推出新视频功能,为小企业简化视频广告制作,并加快新创意工具上市。
OpenAI Academy 扩展学习路径,面向员工、开发者、领导者、教育者和学生,帮助其构建并展示实用 AI 技能。
llm-keys-ui 0.1 插件解决了在 Codex Remote 会话中安全配置 API 密钥的问题。运行 `uvx --with llm-keys-ui llm keys-ui --all` 即可启动界面,提供本地网络或 Tailscale 的 URL 用于保存密钥,之后可用 `llm keys get anthropic` 等命令获取密钥。
Cooley 利用 ChatGPT Work 构建了 GO Public,为 IPO 流程引入智能,帮助律师更早发现潜在问题,并将判断力集中于最关键的环节。
OpenAI 发布面向法律行业的 Astra for Law,为法律领域带来前沿智能。该产品可定制律所工作流、接入关联法律数据源,并为机密客户工作提供法律级别的安全管控,旨在满足法律从业者的专属需求。
OpenAI推出新的AI驱动广告体验,包括Sponsored Agents、面向营销人员的工具,以及与HubSpot和Shopify的集成。这些功能旨在探索智能体在广告投放和营销中的新应用。
Google DeepMind 发布 Gemini 3.8 Live 和 3.8 Live Extended Thinking 两款新语音对话模型,主打近实时推理。
推荐理由:官方基准显示新模型在语音智能体任务上领先并在成本上有竞争力,可据此判断生产环境中的应用价值。
NVIDIA 在 AI 基础设施峰会上将AI工厂能效列为核心议题,其 DSX MaxLPS 软件在 Lambda 的首次验证中,于相同功率预算下将集群 token 吞吐量提升 24%,性能每瓦提升 23%。
OpenAI 发布 Agents API,一个由 Codex harness 驱动的托管服务,支持智能体的编排、长会话和工具调用,用于构建和部署云智能体。
推荐理由:原文点出 Agents API 的定位与三大核心能力,读者可据此判断其编排、长会话与工具调用的适用场景。
OpenAI 发布 ChatGPT Images 2.5,可将想法、草图与参考照片转化为更个性化、更精致的图像,更好地反映用户意图。
OpenAI推出Daybreak计划,承诺投入10亿美元,扩大关键服务对前沿网络AI、培训和支持的获取。该资金将用于加强基本服务的网络防御能力。
Legora 在金融审查工作流中使用 GPT-6 Astra,几分钟内审查了 41 份文档,找出了全部四处人为植入的错误,并将性能提升近 40%。
Playco 使用 GPT-6 Astra 从同一个灰盒基础构建了三个主题游戏原型,手动修复次数比上一代模型减少 50%。
Google DeepMind推出智能体视频理解功能,适用于Gemini 3.7 Flash、3.6 Flash和3.5 Flash-Lite,将视频分析的token消耗最高降低88%、成本最高降低66%,准确率提升最高7%。
推荐理由:官方公布agentic视频理解相比静态处理在token消耗、成本和准确率上的具体改进数字,读者可据此判断该方案对长视频分析开发流程的实际影响。
Google DeepMind 发布 Gemini Omni 1.1 Flash,通过 Gemini API 正式开放,新增场景扩展、首末帧指定、视频参考等生成视频能力。
推荐理由:官方给出了场景扩展、4K 放大等具体能力规格和定价,可帮助开发者评估能否直接接入生产工作流。
Google DeepMind 于 2026 年 7 月推出 ATL Saathi,一个基于 Gemini 的网页应用,为印度 Atal Tinkering Labs 教师提供 24/7 教学规划与培训助手。