AI快讯Skild AI S1NVIDIA Physical AI机器人基础模型上下文学习

NVIDIA × Skild AI S1|机器人从单段视频学习陌生的长流程任务

S1 以视频作为上下文提示,在不更新权重的情况下执行新任务;厂区采用前仍需独立验证安全、稳定性和恢复能力。

ENHE AI5 min0 views
NVIDIA × Skild AI S1|机器人从单段视频学习陌生的长流程任务

本文核心看点

NVIDIA 于 9 月 10 日介绍 Skild AI 的 S1 机器人基础模型。操作者录制任务视频作为提示,模型解析意图、物体与步骤,在不更新权重或进行任务专项后训练的情况下映射为机器人动作。官方文章称,S1 可执行最长 10 分钟的陌生多步骤任务;Skild 自测中每步成功率约 66%,对比系统为 9%。这些是厂商披露的演示与测试结果,并不等于所有环境已可无人值守。落地时仍需在仿真、隔离工位和真实产线逐级验证碰撞、故障恢复与人工停机。

S1 接收操作者录制的视频作为提示,解析任务意图、物体和顺序,再把它们映射为机器人动作,不更新权重也不进行任务专项后训练。
NVIDIA 表示,S1 可执行最长 10 分钟的陌生任务,包括种盆栽、做薄饼、手冲咖啡与套件装配;一次种植演示从录像到硬件自主执行用时 11 分钟。
在 Skild 报告的新多步骤任务测试中,S1 每步成功率约 66%,类似 AI 系统为 9%;这些数字来自厂商测试,文章未把它们定义为跨场景安全认证。

直接回答

NVIDIA 于 9 月 10 日介绍 Skild AI 的 S1 机器人基础模型。操作者录制任务视频作为提示,模型解析意图、物体与步骤,在不更新权重或进行任务专项后训练的情况下映射为机器人动作。官方文章称,S1 可执行最长 10 分钟的陌生多步骤任务;Skild 自测中每步成功率约 66%,对比系统为 9%。这些是厂商披露的演示与测试结果,并不等于所有环境已可无人值守。落地时仍需在仿真、隔离工位和真实产线逐级验证碰撞、故障恢复与人工停机。

事实来源

S1 接收操作者录制的视频作为提示,解析任务意图、物体和顺序,再把它们映射为机器人动作,不更新权重也不进行任务专项后训练。

NVIDIA 表示,S1 可执行最长 10 分钟的陌生任务,包括种盆栽、做薄饼、手冲咖啡与套件装配;一次种植演示从录像到硬件自主执行用时 11 分钟。

在 Skild 报告的新多步骤任务测试中,S1 每步成功率约 66%,类似 AI 系统为 9%;这些数字来自厂商测试,文章未把它们定义为跨场景安全认证。

NVIDIA × Skild AI S1|机器人从单段视频学习陌生的长流程任务 封面信息图
ENHE AI 原创合成图:主题匹配的真实工作场景背景与事实核验文案。

核心变化

  • 新任务可由一段操作者视频提供上下文,而非先建专用数据集
  • 长流程动作由模型组合已有技能并在扰动后尝试恢复
  • 合成数据、仿真、强化学习和推理优化进入同一开发链
  • 厂商演示需要转化为逐工位、逐步骤的独立验收
NVIDIA × Skild AI S1|机器人从单段视频学习陌生的长流程任务 团队操作流程图
把公告转成可测试、可回滚、可审计的四步流程。

对普通 AI 用户的影响

单视频示范降低了适配新工序的前期数据与编程负担,适合变化频繁的装配、物流和操作任务。不过多步骤任务会把单步错误累积成整条流程失败;66% 的单步成功率也不能直接代表端到端良率。普通企业应把示范学习看作缩短配置时间的工具,并继续保留安全围栏、力与碰撞限制、人工急停和失败后的安全状态。

给团队的操作清单

  1. 从低速度、低载荷、无人员进入的隔离工位选择一个可逆任务,并录像固定示范版本。
  2. 在仿真中覆盖物体偏移、遮挡、夹取失败、工具异常与急停,记录每步和整条流程成功率。
  3. 进入硬件测试时限制速度、力、工作空间和连续运行时间,并设置可独立触发的人工停机。
  4. 只有在安全阈值、恢复路径和端到端良率同时达标后才逐步扩大工位与任务范围。

AI 前沿资讯与趋势解读AI 软件应用与模型工具AI 技能教程与验证方法AI 账号服务与权限说明

FAQ

S1 是否需要为每个新任务重新训练模型?

官方称不需要任务专项后训练或更新权重;视频示范作为上下文提示提供任务信息。

66% 成功率是否意味着整条十分钟流程有 66% 成功率?

不是。文章描述的是 Skild 测试中的每步成功率,多步骤流程的端到端概率需要单独测量。

单视频学习是否可以取消人工安全控制?

不可以。文章展示能力与恢复案例,但没有替代厂区风险评估、物理防护、急停或验收。

总结

S1 展示了用视频上下文缩短机器人新任务配置的路径;真正进入生产的门槛仍是逐步可测的安全、端到端良率和故障后可预测的恢复。

本文由 AI 辅助撰写;发布前由 ENHE AI 自动化审计核对官方来源、双语字段、图片权利、页面安全与历史去重。

这对普通用户意味着什么?

单视频示范降低了适配新工序的前期数据与编程负担,适合变化频繁的装配、物流和操作任务。不过多步骤任务会把单步错误累积成整条流程失败;66% 的单步成功率也不能直接代表端到端良率。普通企业应把示范学习看作缩短配置时间的工具,并继续保留安全围栏、力与碰撞限制、人工急停和失败后的安全状态。

你可能会用到这些工具

相关教程

相关工具/教程

你可以从下面的 ENHE AI 栏目继续把资讯信号转成工具选择、账号服务判断或实操学习路径。

相关阅读

AWS OpenAI 模型评测|从每 Token 价格转向每个正确结果的真实成本

AWS 于 9 月 11 日发布一套开源评测方法,比较 Amazon Bedrock 上的 GPT‑5.6 Luna、Terra、Sol 与 OpenAI API 上的 GPT‑5.4 mini、nano。它不只看每百万 Token 价格,而是测量每个正确答案、通过的多轮研究结果和合格专业交付物的成本。文章公开了样本量、评分器、配置与局限,并强调 Bedrock 模型关闭推理、API 基线使用默认设置,因此结果不是模型固有能力排名。团队应在自己的 50 至 100 个任务上重跑,并同时核算失败、返工、轮次与延迟。

Structured Outputs 上线门禁|把 Schema、拒答与截断纳入发布验收

Structured Outputs 让兼容模型按受支持的 JSON Schema 返回数据,比仅保证合法 JSON 的 JSON mode 更适合业务流程。它可用于函数调用或结构化响应;严格模式要求对象关闭额外属性、字段全部必填,可空值通常用含 null 的联合类型表达。Schema 通过只证明结构符合约束,不代表事实正确、业务规则满足或调用完整。上线前应固定模型与 Schema 版本,覆盖正常、拒答、输出截断、内容过滤和不受支持 Schema,并在解析后执行语义校验与安全失败处理。

OpenAI Habitat|70M+ RPS 的在线存储如何从 Python 迁往 Rust

OpenAI 于 9 月 11 日披露在线存储平台 Habitat 的扩展历程。官方称,该平台目前每秒处理超过 7000 万次请求,服务每周逾 10 亿用户、近 40 个地区并承载超过 500 PB 数据。Habitat 从 Python 客户端库演变为集中式服务;2026 年第二季度,两名工程师借助 Codex 与 GPT‑5.5 完成 Rust 重写,目前承接 95% 生产请求。文中数据是 OpenAI 的内部测量,团队应借鉴迁移方法,而不是直接套用性能结论。

Salesforce Slackforce Surfaces|让 Slackbot 把业务上下文变成共享实时界面

Salesforce 于 9 月 11 日推出 Slackforce Surfaces,让用户通过 Slackbot 把对话、Salesforce 记录、Slack 历史和已连接企业数据生成仪表盘、报告、演示或其他交互界面。Surface 可固定在频道供团队筛选、讨论和继续行动,并沿用现有访问权限。该功能已面向启用 Slackbot 的多类 Slack 套餐提供,但官方明确说明实时数据功能从 10 月开始推出;当前使用前应核对工作区资格、数据刷新状态与可追溯来源。

Google 100 ZEROS 威尼斯 XR 首映|Gemini 对话、空间影像与 2D 转 3D 同台

Google 于 9 月 11 日介绍 100 ZEROS 团队支持的三部扩展现实作品,它们在第 83 届威尼斯国际电影节首映,并面向 Android XR。NEVATARS 以 Gemini 驱动角色对话和互动;《Galápagos: The Last Eden》让观众与 Gemini 驱动的数字达尔文互动;Sedona 则使用 Google 的 2D 转 3D XR 自动空间化技术在 YouTube 呈现悬疑预告。官方把这些项目定位为技术与创作者协作的探索,未宣称生成式工具替代编剧、导演或表演者。

NVIDIA 供应链 Nemotron 案例|把专家分配决策变成受治理的训练闭环

NVIDIA 于 9 月 10 日发布与 Palantir Foundry 的供应链案例:将专家的物料分配决策、理由与实际结果写入受治理 Ontology,再以点时回测训练 Nemotron 3.5 Lightning。后训练 30B 专用模型在开发基准取得 86.7% 分配决策准确率,但该结果只适用于受限任务与该评测;人工规划师仍作最终决定,不能推断其通用推理能力更强。

参考来源

文章目录

最新资讯