論文の概要: Initiation Safety: A Missing Dimension in Generalist-Robot Safety
- arxiv url: http://arxiv.org/abs/2607.07420v2
- Date: Wed, 15 Jul 2026 13:02:13 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-16 14:31:40.664068
- Title: Initiation Safety: A Missing Dimension in Generalist-Robot Safety
- Title(参考訳): ジェネラリストロボットの安全性の欠如
- Authors: Zhijin Meng, Francisco Cruz,
- Abstract要約: 第3の疑問が欠落していると私たちは主張している。ロボットは、その最初の難解なソーシャルアクションを、まったく受け入れるべきだろうか?
現在のフレームワークでは,個別のセーフティレイヤとして扱うことは滅多にありません。
我々は、ジェネラリストロボットの安全性の中で開始認可をフレーム化し、計画後のVLAガードレールと対比する。
- 参考スコア(独自算出の注目度): 0.0
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Safety for generalist robots is usually discussed in terms of motion or dialogue. We argue a third question is missing: should the robot take its first hard-to-undo social action at all, such as a greeting, an uninvited grasp, or stepping into someone's space? We call this initiation authorization. Current frameworks rarely treat it as a separate safety layer. Today's stacks often skip this step: a high engagement score or a confident VLA rollout is treated as permission to act. But seeing a person is not the same as having their consent to be addressed. We frame initiation authorization within generalist-robot safety and contrast it with post-plan VLA guardrails, implementing PAS (probe-authorize-speak) on a doorway humanoid, comparing it with direct-init on logged traces, and proposing a three-condition user study, with open questions on metrics, governance, and where initiation ends and foundation-model generation begins.
- Abstract(参考訳): ジェネラリストロボットの安全性は通常、動きや対話の観点から議論される。
ロボットは、挨拶、招待されない抱きしめ、あるいは誰かの空間に足を踏み入れるなど、初めて、やりにくいソーシャルアクションを全く受けるべきだろうか?
私たちはこれを開始認可と呼ぶ。
現在のフレームワークでは,個別のセーフティレイヤとして扱うことは滅多にありません。
今日のスタックは、高いエンゲージメントスコアや確実なVLAロールアウトを行動許可として扱うことで、このステップをスキップすることが多い。
しかし、相手を見ることは、相手の同意を得るのと同じではない。
我々はジェネラリストロボットの安全性の中で初期化許可を定め、それをポストプランVLAガードレールと対比し、戸口ヒューマノイドにPAS(probe-authorize-speak)を実装し、ログされたトレースの直接入出力と比較し、3条件のユーザスタディを提案し、メトリクス、ガバナンス、開始終了と基盤モデル生成の開始点についてオープンな質問をする。
関連論文リスト
- Propagating Unsafe Actions in LLM Controlled Multi-Robot Collaboration via Single Robot Compromise [26.689718481370903]
大規模言語モデル (LLMs) は、インテリジェンスにおける一般的なプランナーとしてますます使われている。
対戦相手が単一のエントリーロボットのみと対話するマルチロボットシステムに対する新たな攻撃パラダイムを提案する。
私たちはこのプロセスを3つのメトリクス、服従、伝染、ステルスネスで定量化します。
論文 参考訳(メタデータ) (2026-05-15T05:45:52Z) - Can AI Perceive Physical Danger and Intervene? [16.825608691806988]
AIが物理的な世界と対話するとき、新しい安全上の課題が生まれる。
最先端のファンデーションモデルは、物理的な安全性に関する常識的な事実をどの程度理解していますか?
論文 参考訳(メタデータ) (2025-09-25T22:09:17Z) - Oyster-I: Beyond Refusal -- Constructive Safety Alignment for Responsible Language Models [93.5740266114488]
コンストラクティブ・セーフティ・アライメント(CSA)は、悪意のある誤用を防ぎつつ、脆弱性のあるユーザを安全で有益な結果へと積極的に誘導する。
Oy1は、高度な汎用能力を保ちながら、オープンモデル間の最先端の安全性を達成する。
私たちは、責任あるユーザ中心AIをサポートするために、Oy1、コード、ベンチマークをリリースしています。
論文 参考訳(メタデータ) (2025-09-02T03:04:27Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。