Gemini Robotics-ER 1.6 发布:强化具身推理能力
Google DeepMind 发布 Gemini Robotics-ER 1.6,这是其具身推理模型的重要升级,今天起通过 Gemini API 和 Google AI Studio 开放给开发者。
推荐理由:原文给出 Gemini Robotics-ER 1.6 在空间推理、仪表读数与安全能力上的提升,并开放 API 供开发者接入,便于判断其实际可用性。
Google DeepMind 发布 Gemini Robotics-ER 1.6,这是其具身推理模型的重要升级,今天起通过 Gemini API 和 Google AI Studio 开放给开发者。
推荐理由:原文给出 Gemini Robotics-ER 1.6 在空间推理、仪表读数与安全能力上的提升,并开放 API 供开发者接入,便于判断其实际可用性。
Google DeepMind 发布开源模型 Gemma 4,提供 E2B、E4B、26B MoE 和 31B Dense 四个尺寸,采用 Apache 2.0 许可,31B 模型在 Arena 文本榜单位列开源模型第 3。新模型支持 140+ 语言、最高 256K 上下文、原生多模态与语音输入,可离线运行于手机等边缘设备,并兼容 Hugging Face、vLLM、Ollama 等主流工具。
推荐理由:官方披露 Gemma 4 四个尺寸与 Apache 2.0 许可,有助于评估其智能-参数比优势和本地部署门槛。
Google DeepMind 发布由 Gemini 驱动的 AI 增强指针,让指针不仅能识别指向目标,还能理解它对用户为何重要。该设计基于保持流畅、展示与讲述、拥抱 This/That、像素实体化四项交互原则;即日起可在 Chrome 里用指针向 Gemini 询问网页内容,不久推出 Googlebook 的 Magic Pointer,并可在 Google AI Studio 试用。
推荐理由:DeepMind 提出让指针理解指向目标与用户意图的四条设计原则,并已集成进 Chrome,是观察下一代 AI 交互入口形态的窗口。