AI ResearchNotes.法人向けのご案内 ↗
← 検索結果に戻る

ロボットの動作生成中に障害物との距離を反映するNUDGE

NUDGE

保存した記事を見る
原論文の図

NUDGEの原論文から掲載した図です。細部はクリックして拡大できます。

原論文の図の説明を読む

Fig. 1: NUDGE provides zero-shot collision avoidance for generative robot policies at inference time. (a) From a live point cloud, NUDGE computes a signed distance field in real time to react to scene changes, injects its gradient into the policy’s denoising loop, and steers the predicted action chunk away from obstacles. (b) We fine-tuned a π 0 \pi_{0} policy for a table-cleaning task, where the policy learns to model the contact and task distribution from demonstrations. Top: the unguided baseline collides with the pool noodle. Middle & Bottom: NUDGE avoids the obstacle at the extra cost of only 2.5 ms per action chunk.

出典:NUDGE / arXiv ↗

概要

  • NUDGEは生成途中の短い動作列を、障害物までの距離を使って修正する。
  • 球面移動課題では、著者らの設定で接触なしの目標到達率が37.0%から71.5%になった。
  • 実機UR5でも試したが、姿勢間の連続軌道は衝突費用で直接検査していない。
補足:編集した模式図で仕組みを確認する

VISUAL EXPLAINER

図でつかむ、NUDGEの仕組み

左から右へ読む
  1. 01現在姿勢と障害物形状
  2. 02短い動作列を予測
  3. 03衝突費用で修正
  4. 04回避する動作列

原論文の説明をもとにした模式図です。処理の細部は省略しています。

研究の背景

NUDGEは、障害物のない実演から作業を覚えたロボットが、初めて見る障害物を避けながら動くための方法である。生成型の方策は、一度に短い動作列を作り、観測に応じて次の動作列を作り直す。障害物を学習時に見ていなければ、把持や運搬の動きはできても周囲に接触し得る。

障害物を避けるために完成後の動作列を捨てると、作業そのものが進みにくくなる場合がある。著者らは、方策が動作を生成している途中へ障害物との距離を反映する方法を検討した。

手法

まず、観測した障害物から符号付き距離場を作る。これは空間の各点について、最も近い障害物表面までの距離を返し、障害物の内側は負の値にする情報である。方策が生成途中に出す短い動作列を将来の関節姿勢へ変換し、腕や保持物を球で近似して、各時点で十分な間隔があるか調べる。

距離が足りないほど大きくなる衝突費用を計算し、その費用を下げる方向を動作列へ戻す。微分とは、この場合、動作をどちらへどれだけ変えると費用が下がるかを求める操作である。修正した動作列を方策の生成過程に戻して続きを計算し、実行後は新しい観測で再び計画する。

新規性

NUDGEは、学習済みのロボット方策が短い動作列を生成している途中で、障害物を避ける方向へ動作列を少し修正する。障害物を含む実演データで方策を再学習せず、方策が学んだ作業動作を使い続けられるよう設計した。

関節角度や手先位置など、方策が出す動作の表し方が違っても、微分可能な変換を通して関節軌道へ戻し、ロボットの各部位の距離を評価できる。実際の衝突ゼロを保証する仕組みではない。

従来手法との違い

修正しない基準方策は、障害物のない実演で学んだ作業動作をそのまま出す。RAILは完成した動作列が危険なら安全な代替動作へ置き換えるのに対し、NUDGEは生成途中の動作列を修正する。OmniGuideとの比較では、NUDGEは手先付近だけでなくロボット全体の部位を球で近似して距離を調べる。

比較法には見ている部位や環境の復元法にも違いがある。例えばLIBEROでのRAILにはシミュレーターの正解形状が使われた。結果の差を一つの修正規則だけに帰することはできない。

実験結果

著者らは球面に沿う移動課題の200試行で、接触せず目標に着く成功率を、修正なしの37.0%からNUDGEの設定値0.07で71.5%へ上げたと報告する。同設定で衝突を含む試行は54.0%から2.5%へ減った。球面からのずれも測り、作業動作を維持できるかを確認している。

物を移すLIBERO-Objectの10課題では、障害物1個の場合の平均成功率が30%から44%、接触した制御時点の割合が13.15%から2.30%だった。実機UR5ではNUDGEの82試行中62試行が接触なく完了し、修正なしは18試行中3試行だった。両者の試行数は異なる。

応用の可能性

編集上の応用案 · 論文が実証した用途とは区別しています。

編集上の応用案。棚から物を取って容器に移すロボットが、途中に置かれた箱を避ける場面を想定する。入力はカメラから作った障害物の距離情報、現在の関節状態、既存方策への作業指示である。出力は、箱から距離を取りながら把持と移動を続ける短い動作列とする。

各動作列の最初の部分を実行したら、周囲を観測して次の動作列を作り直す。作業対象をつかめたか、腕の一部が箱に触れたか、動作が止まり続けたかを記録し、単に接触を減らすだけで作業が進まなくなる場合も見分ける。

導入時の検証

導入時の検証案 · 対象データでの再評価が必要です。

導入時の検証案。障害物のない作業で既存方策の成功率を記録し、次に位置をそろえた障害物ありの場面で修正なしとNUDGEを比べる。入力となる距離場が障害物を捉えているか、腕と保持物のどの部位を評価するかを先に点検する。

各条件で作業成功率、接触した試行の割合、動作が止まった回数、1動作列を作る時間を測る。障害物を増やした場合も同じ指標で確認し、接触が減っても把持や運搬ができなくなる設定は採用しない。

限界と課題

著者らの衝突費用は、短い動作列中の離散的な姿勢で障害物との距離を測り、姿勢間を連続して通過する軌道全体は調べない。また、動作列の途中推定を取り出せる拡散型またはフローマッチング型の方策が対象で、動作を一つずつ文字列のように出す方式は範囲外としている。

編集上は、距離場が実物の位置を十分正しく表すか、観測の遅れや見えない障害物があっても作業できるかを確かめたい。現場導入には、衝突率だけでなく、停止や把持失敗を含めた作業全体の成否を測る必要がある。

応用先の候補
研究内容と応用案に基づく分類です。業界での導入実績を示すものではありません。

出典

元のタイトル・要旨を確認する(英語)

Zero-Shot Reactive Obstacle Avoidance for Generative Robot Policies

We propose NUDGE (Nudge Update via Differentiable GEometry), a training-free obstacle-avoidance procedure that can be incorporated in any robot policy based on diffusion or flow matching, including diffusion policies and vision-language-action models. Our work injects gradients from a signed distance field, a function returning each point's distance to the nearest obstacle, into the policy at inference time to steer it away from obstacles. It supports any common action parameterization, from absolute or relative joint poses to end-effector poses, through a differentiable joint-trajectory decoder. Experiments show that NUDGE preserves the policy's task distribution and runs reactively in real time.

論文本体の取得範囲に基づく解説。AIが作成した未校閲の記事です。性能の数値は著者の評価条件に依存します。応用例と検証計画は編集上の提案です。解説更新:2026-09-29