YouTube承诺今年晚些时候推出自定义信息流和更多AI功能
YouTube在Made on YouTube活动上承诺今年晚些时候带来自定义信息流和更多AI功能。自定义信息流(Custom Feeds)可让用户通过描述生成新标签页,支持保存多个,先在美国的网页、移动和电视端推出;评论将支持GIF发布,私信也将新增群聊功能。
YouTube在Made on YouTube活动上承诺今年晚些时候带来自定义信息流和更多AI功能。自定义信息流(Custom Feeds)可让用户通过描述生成新标签页,支持保存多个,先在美国的网页、移动和电视端推出;评论将支持GIF发布,私信也将新增群聊功能。
该方案在AWS上构建单一AI智能体,运行时按用户提问选择工具,对上传的视频返回自然语言答案。已分析内容的响应不到1秒,新视频初次分析需5–10分钟,代码已在GitHub开源。一家大型媒体娱乐公司采用后,对200多个多小时录音的手动审查时间减少约80%(未经独立验证)。
OpenAI Academy 迎来成立两周年,并将 AI 技能带给更多社区。
Google DeepMind 推出 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持用自然语言提示从零创建人物声音,并逐行控制台词演绎。
推荐理由:原文给出了自定义声音与逐行导演的具体入口和能力边界,读者可据此判断新模型如何改变配音和语音交互的工作流。
Radical Numerics CEO Eric Nguyen称生物安全正成为一场AI军备竞赛,防御方目前处于劣势。他在Arc Institute参与开发了Evo和Evo 2基因组语言模型,这些模型曾被用来生成完整噬菌体基因组并合成功能性病毒。新创立的Radical Numerics正构建并扩展GLM,实验中模型能沿RNA适配体分数阶梯自行推断更高分序列,展示了“DNA语言中的链式推理”。
OpenAI 将 Daybreak 项目的访问权限扩展至乌克兰政府,用于支持民用基础设施的网络防御。
OpenAI CEO Sam Altman在联合国安理会发表讲话,谈及AI安全、人类控制与国际合作。他强调了在人工智能发展过程中确保人类掌控和全球协作的重要性。发言未提及具体模型版本或技术参数。
MentalHealthBench 是一个由专家指导的基准,专注于现实心理健康对话场景,评估 AI 响应的帮助性与安全性。
本期 Latent Space 访谈邀请拥有奥斯卡奖、两颗以自己命名的小行星的 Google 科学家 John Platt,重点讨论其团队开发的 Empirical Research Assistance(ERA)。
GPT-6 改进了提示词缓存,实现更高的缓存命中率,并新增诊断功能、显式断点以及降低延迟和成本的控制手段。
微软周二宣布主导了一次行业范围的行动,捣毁名为EvilTokens的订阅制诈骗平台,该平台利用AI聊天机器人在数月内入侵了12,000个微软账户。该平台2月通过Telegram推出,收取1,500美元初始费用和每月500美元的订阅费。其核心是能分析受害者收件箱的AI聊天机器人,可帮助犯罪分子识别信任关系和支付授权,并模仿可信联系人起草欺诈消息。
不列颠哥伦比亚省对OpenAI提起诉讼,要求其为Tumbler Ridge枪击案相关的新建学校买单,并交出涉事枪手的ChatGPT日志。这是针对AI在真实暴力事件中角色的责任追究,也是政府向模型提供商追责的新案例。
GPT-6 Sol 和 GPT-6 Luna 现已通过 Amazon Bedrock 正式可用,API 定价较 GPT-5.6 前辈显著降低。Sol 面向开发中的复杂重复任务,编码和计算机使用能力提升,内部评估事实错误约减半;Luna 面向高频任务,支持调整推理成本,两者均支持显式提示词缓存。
推荐理由:原文说明 GPT-6 Sol 与 Luna 在 Amazon Bedrock 上的正式可用性,并给出各自定位、更低的 API 定价与提示词缓存细节,可据此按任务成本选型。
TikTok 用户 @therealcornpop 日前发文称,用 AI 写 YouTube 和 TikTok 脚本的痕迹非常明显,除了“不是 X,而是 Y”句式、规则三和破碎的顿句等通用 AI 腔外,更关键的是缺乏个人声音,能看出作者对所讲内容没有真正观点。
OpenAI 发布 GPT-6 Sol 和 Luna 两款新模型,定位是把前沿智能带到日常工作中。两款模型在能力与成本之间做了不同的平衡。
Claude Opus 5.5 已在 Amazon Bedrock 和 Claude Platform on AWS 上线。相比 Opus 5,它用更少 token 完成任务且单价与缓存读取更便宜,平均单任务成本更低,并首次为 Opus 系列加入生物、网络安全和 AI 发展领域的安全分类器。模型支持自适应思考,可通过 Bedrock 控制台或相关 API 调用,覆盖多个地理区域的推理配置。
推荐理由:AWS 官方博客给出了 Opus 5.5 的效率与成本优势说明,并附 Bedrock 调用示例,便于开发者评估部署价值。
llm-anthropic 0.29 发布,这是 llm 工具的 Anthropic 插件版本更新。
Simon Willison 发布 llm-typesafe 0.1a0 插件,为他的 LLM 命令行工具接入 TypeSafe AI 的 Jev 模型。通过 llm install llm-typesafe 安装并设置 API key 后,可用 -m jev 指令完成 yes/no 的 noul 判断、choice 选择和 score 评分三类类型安全结构化输出。
NVIDIA 在加拿大多伦多 ROSCon 上发布 Isaac ROS 5.0,为约 130 万 ROS 用户带来 Agent 化开发工作流,并新增对 ROS Lyrical 和 Ubuntu 24.04 的支持。
Anthropic和OpenAI今夏接连声称其模型在漏洞挖掘、数学突破上超越人类专家,但专家核查发现不少说法夸大,OpenAI的数学成果还被质疑研究不端和抄袭。文章认为“超级智能”“失控模型”等叙事实为营销策略,意在转移责任并推动政策,呼吁决策者和公众保持怀疑,勿被公司宣传误导。
小米发布 MixMo-V2.6 系列开源原生全模态模型,其中 Pro 版在 Artificial Analysis 智能指数上以 46 分登顶开源权重模型,模型约 1.02T 总参数、42B 活跃参数,MIT 许可;Flash 版平衡智能、效率与成本,UltraSpeed 版提供高达 20 倍的输出速度。
TypeSafe AI 发布决策模型 Jev,只接收文本输入、返回是/否、选项与评分的置信度浮点数,输出免费且输入定价低于 GPT-5 Nano。Simon Willison 实测认为它适合分类、意图判定与搜索重排,但黑盒输出让偏见与错误难以定位。他已为 LLM CLI 发布 llm-typesafe 插件,社区也出现 Kev 等开放权重复刻项目与 JevBench 基准。
TypeSafe AI 推出面向软件的 System One 模型 Jev,CEO Diogo Almeida 在访谈中解释其 RLCD 训练法如何用校准概率替代 RLHF 的人类反馈,并主张开发者把 AI 当作软件依赖而非聊天助手。
推荐理由:访谈剖析了 Jev 为何押注校准决策而放弃 RLHF,并给出编码代理、游戏操控等具体用例,便于开发者判断 System One 模型的适用场景。
NVIDIA 推出 DSX Ready 资格认证项目,面向满足 NVIDIA DSX AI 工厂参考设计要求的电源与冷却产品,首批涵盖电池储能系统(BESS)和冷却分配单元(CDU)。
埃及AI生态系统正从概念培育转向规模化生产,NVIDIA在开罗举办活动并推动当地开发者、初创企业与数据中心投资落地。NVIDIA Deep Learning Institute在埃及的学习者一年内增长超十倍;Hassan Allam数据中心获埃及监管机构许可,拟投资约4亿美元建设新设施。
NVIDIA 主张将 AI 安全作为工程问题处理,在智能体栈各层级落实安全要求、可控策略与责任归属,强调运行时环境须在智能体推理之外独立施加边界限制。NVIDIA OpenShell 提供开源安全运行时,在智能体能力之外强制策略并支持沙箱执行,Cisco DefenseClaw 与 JFrog 已基于其构建治理与技能扫描能力。
OpenAI 正在与一个独立的数学与人工智能咨询小组合作,以指导对新兴 AI 结果的审查与沟通。
Higgsfield AI 借助 GPT-6 Astra 在一天内推出新视频功能,为小企业简化视频广告制作,并加快新创意工具上市。
OpenAI 提出一条通往全球共享 AI 标准的路径,呼吁协调评估、报告与治理,以提升安全性。
OpenAI Academy 扩展学习路径,面向员工、开发者、领导者、教育者和学生,帮助其构建并展示实用 AI 技能。
作者反驳“MCP一直是个坏主意”的说法,认为对需要精细控制外部服务访问、安全处理API密钥、提供用户连接界面和清晰审计日志的场景,MCP仍不可或缺,其价值远不止于全功能终端代理。
llm-keys-ui 0.1 插件解决了在 Codex Remote 会话中安全配置 API 密钥的问题。运行 `uvx --with llm-keys-ui llm keys-ui --all` 即可启动界面,提供本地网络或 Tailscale 的 URL 用于保存密钥,之后可用 `llm keys get anthropic` 等命令获取密钥。
AI 生成的代码仍需人工审查,RAG 并未消亡,Skills 也未能取代 MCP——GitHub 博客逐条剖析这些热点观点。作者强调代码审查责任、检索增强生成的价值,以及 Skills 与 MCP 的互补关系,并指出微调并非代码质量差的借口,这些工具应协同使用而非相互取代。
OpenAI 发布澳大利亚青少年安全蓝图,提出六支柱路线图,旨在为青少年打造更安全的 AI 体验,保护并赋能年轻人。该蓝图聚焦于如何在 AI 产品中落实青少年安全措施。
AINews 汇总 9/16-9/17 AI 动态:Anthropic 在 Claude Code 推出 Projects,支持单对话生成并行云端会话并在用户离开后继续运行;OpenAI 发布 Astra for Law,含 26 个合作伙伴插件与 47 个社区插件,宣称在合法基准上全价位胜过通用 GPT-6 Astra 加网页搜索。
Cooley 利用 ChatGPT Work 构建了 GO Public,为 IPO 流程引入智能,帮助律师更早发现潜在问题,并将判断力集中于最关键的环节。
OpenAI 发布面向法律行业的 Astra for Law,为法律领域带来前沿智能。该产品可定制律所工作流、接入关联法律数据源,并为机密客户工作提供法律级别的安全管控,旨在满足法律从业者的专属需求。
AIUC 联合创始人 Rune Kvist 在访谈中宣布完成由 Ribbit Capital 和 First Harmonic 领投的 4000 万美元 A 轮融资,团队现有 20 人,客户包括 Cursor、Harvey、Lovable、ElevenLabs。
NVIDIA Vera Rubin NVL72 首次提交 MLPerf Inference v6.1 评测,在 Qwen3-VL 上吞吐量最高可达 GB300 NVL72 的 3.7 倍,在 DeepSeek-R1 上提升达 2.5 倍。GB300 NVL72 四机架扩展效率达 99%,软件优化较 v6.0 提升最高 1.6 倍。
推荐理由:原文给出了 Vera Rubin 在 MLPerf 上相对 GB300 的具体吞吐提升倍数和扩展效率,读者可据此评估新一代平台在推理经济性上的实际价值。
Emerald AI、Google 和 NVIDIA 宣布成立 AI 能源管理联盟(AEMA),推动数据中心能根据电网状况动态调整用电,以换取更快、更大的并网接入。