論文の概要: Builder, Defender, Breaker: The Case Against Removing the Human from the AI-Driven Security Lifecycle
- arxiv url: http://arxiv.org/abs/2607.03215v1
- Date: Fri, 03 Jul 2026 11:29:44 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-07 22:26:29.559824
- Title: Builder, Defender, Breaker: The Case Against Removing the Human from the AI-Driven Security Lifecycle
- Title(参考訳): ビルダー、デフェンダー、ブレーカー:AI駆動のセキュリティライフサイクルから人間を取り除こうとする事例
- Abstract要約: 我々は、人間は一時的な足場ではなく、恒久的な構造的要件としてループに属していると論じる。
自動コード生成、対向機械学習、ソフトウェアフォールトトレランス、および最初の全マシンハッキングトーナメントのエビデンスに基づいて、人間は一時的な足場としてではなく、永続的な構造的要件としてループに属していると論じる。
- 参考スコア(独自算出の注目度): 0.0
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Artificial intelligence has spread across the whole of the security lifecycle. The same family of models now writes application code, hardens it, and probes it for weaknesses, so that a single generative substrate increasingly performs all three roles at once. Enthusiasm for this convergence tends to treat full autonomy as the natural end point of partial assistance. This article argues that it is not. When the system that builds an artifact is drawn from the same distribution as the systems that defend and test it, the three roles inherit a common set of blind spots, and the independence that makes verification meaningful is quietly lost. Removing the human does more than raise the automation level: it collapses the external oracle against which machine output is judged, outruns the point at which a person could intervene, hands adversaries a predictable and poisonable target, and dissolves the locus of accountability when something fails. Drawing on evidence from autonomous code generation, adversarial machine learning, software fault tolerance, and the first all-machine hacking tournaments, we argue that the human belongs in the loop not as a temporary scaffold but as a permanent structural requirement, and set out what a defensible division of labour between people and machines should preserve.
- Abstract(参考訳): 人工知能はセキュリティライフサイクル全体に広がりました。
同じモデルのファミリーがアプリケーションコードを書き、それを硬化させ、弱点を調査し、単一の生成基板が一度に3つの役割をすべて果たすようにした。
この収束に対する熱意は、完全な自律性を部分的な援助の自然な終点として扱う傾向がある。
この記事はそうではないと論じている。
アーティファクトを構築するシステムは、それを守り、テストするシステムと同じ分布から引き出される場合、3つの役割は共通の盲点の集合を継承し、検証を有意義にする独立性は静かに失われる。
機械の出力が判断される外部のオラクルを崩壊させ、人が介入できる地点を突破し、敵に予測可能で有毒な標的を渡し、何かが失敗すると説明責任の軌跡を解消する。
自動コード生成、逆機械学習、ソフトウェアフォールトトレランス、および最初の全マシンハッキングトーナメントのエビデンスに基づいて、人間は一時的な足場としてではなく、恒久的な構造的要件としてループに属し、人と機械の間の防御力の分断が保持すべきものであることを論じる。
関連論文リスト
- Skill Composition for Legged Robot Reinforcement Learning [4.917317902787791]
我々は、独立行政の構成は、それ自体が研究上の問題として扱われるべきであると主張する。
特定のポリシー間で制御を安全に行うことができれば、ロボットが次にすべきことは、まったく異なる性質の構成要素に委譲することができる。
論文 参考訳(メタデータ) (2026-09-13T16:32:17Z) - Adversarial Attacks for Good: A Survey of Proactive Protection across the Visual Content Lifecycle [65.6642776933861]
この介入点付近で成長した保護パラダイムについて検討する。
ほとんどの保護は、主に静的あるいは弱い適応的な敵に対して検証されている。
我々は、堅牢で構成可能で、デプロイ可能な所有者側の保護のために、クロスステージ対策とオープンな問題を統合することで、閉鎖する。
論文 参考訳(メタデータ) (2026-08-05T00:46:50Z) - The Boundaries of Automation: A Theory of Persistent Human Participation [107.84677954791773]
高い能力を持つAIシステムであっても、人間の参加は継続する可能性がある、と私たちは主張する。
一部のアクティビティでは、ターゲットは事前に完全に指定されるのではなく、代わりにインタラクション自体を通じて現れる。
この観点は、自動化の限界に重要な意味を持つ。
論文 参考訳(メタデータ) (2026-07-23T17:33:43Z) - Towards an Intention Abstraction Layer for Autonomous Industrial Systems [0.12744523252873352]
高レベルの人間の意図は、低レベルの制御ロジックに変換され、破棄される。
実行中のコンポーネントが、実際に意図されたことを実行しているかどうかを判断できず、目標が失敗したり、シャットダウンされた後にのみ、目標の衝突が表面化します。
Intention Abstraction Layer (IAL) は、意図を第一級、永続的で説明可能なランタイムオブジェクトとして表現するドメイン固有性である。
論文 参考訳(メタデータ) (2026-07-16T04:31:20Z) - Defeat Devices in AI Systems [8.970269049715933]
2015年のフォルクスワーゲン排出ガス事件(Volkswagen emissions case)で広く注目を集めた。
本稿では,3つの軸に沿って文書化された事例(オリジン,トリガー,スワップ機構)を整理し,法医学的検出プロトコルとしてTrigger-Axis-Aware Differential Probing (TADP)を提案する。
我々は、自然に出現する倒産デバイスを、AIの安全実践が体系的に監視し、テストすべき有害な現象の1つとして特徴づける。
論文 参考訳(メタデータ) (2026-06-27T11:12:17Z) - The Unfireable Safety Kernel: Execution-Time AI Alignment for AI Agents and Other Escapable AI Systems [0.0]
本稿では,AIシステムのアーキテクチャ制御を実現するRustリファレンス実装であるUnfireable Safety Kernelを紹介する。
我々は,生きた,回避可能なAIシステム,決定論的,自己改善的な世界モデルを管理するカーネルを,逃げ出す敵に対して評価する。
論文 参考訳(メタデータ) (2026-06-24T17:32:27Z) - Framing, Judging, Steering: An Assessable Competency Model for Teach-ing Students to Reason With Generative AI [47.027290803102666]
生産的AI利用を3つの評価可能なスキルに分解する能力モデルであるCoRe-3(Co-Reasoning)を提案する。
理論上のスキルを基盤として、5つのテスト可能な提案を述べ、それらをCoReasoningLabでインスタンス化します。
人為的な合意と成果が次々に行われます。私たちは、計測器、データ、プロトコルをリリースします。
論文 参考訳(メタデータ) (2026-06-04T10:25:31Z) - The Digital Apprentice: A Framework for Human-Directed Agentic AI Development [0.0]
我々は,自律性を前提とせず,スケーラブルで安全なAIエージェンシーのためのフレームワークを提案する。
デジタル・アレンティス(Digital Apprentice)は、人間の暗黙の方法論を内包する発達学習者である。
我々は,データドリフトを捕捉し,実行時に異なる手法を適用することによって,トラフィックシフト時の品質の劣化を回復する方法を示す。
論文 参考訳(メタデータ) (2026-06-03T00:49:13Z) - Provably Secure Agent Guardrail [89.79561918065122]
既存の防衛アーキテクチャは経験的セマンティックガードレールと確率論的大モデル調整器に依存している。
本稿では,論理的推論の基本的制約に基づくエージェントのための新しいセキュリティパラダイムを提案する。
論文 参考訳(メタデータ) (2026-05-28T02:12:41Z) - AutoResearchClaw: Self-Reinforcing Autonomous Research with Human-AI Collaboration [175.74514061083195]
提案するAutoResearchClawは,5つのメカニズムに基づいて構築されたマルチエージェント自律型研究パイプラインである。
25トピックの実験ステージベンチマークであるARC-Benchでは、AutoResearchClawがAI Scientist v2を54.7%上回っている。
論文 参考訳(メタデータ) (2026-05-19T15:49:51Z) - The Devil Behind Moltbook: Anthropic Safety is Always Vanishing in Self-Evolving AI Societies [57.387081435669835]
大規模言語モデルから構築されたマルチエージェントシステムは、スケーラブルな集合知性と自己進化のための有望なパラダイムを提供する。
エージェント社会が継続的自己進化、完全隔離、安全性の不変性を満たすことは不可能であることを示す。
我々は、特定された安全上の懸念を軽減するために、いくつかの解決方法を提案する。
論文 参考訳(メタデータ) (2026-02-10T15:18:19Z) - The Psychology of Learning from Machines: Anthropomorphic AI and the Paradox of Automation in Education [1.8217623940980625]
この研究は、4つの研究伝統を合成し、学習者が人間型AI教師と心理的にどう関係するかを理解するための包括的な枠組みを確立する。
我々は、ジェネレーティブAIの会話流布によって強化された3つの永続的課題を特定する。
われわれはこの理論合成を、AIによる哲学的議論と人間によるエンジニアリングチュートリアルにまたがって、104,984件のYouTubeコメントの比較分析を通じて基礎づけている。
論文 参考訳(メタデータ) (2026-01-07T08:28:33Z) - Cybersecurity AI: The Dangerous Gap Between Automation and Autonomy [0.0]
サイバーセキュリティ産業は「自動化された」AIと「自律的な」AIを組み合わせている。
複雑な攻撃シーケンスを実行するが、エッジケースと戦略的決定に対する人間によるレビューが必要である。
この道は、正確な用語、透明な能力開示、人間とAIのパートナーシップの置き換えを必要としている。
論文 参考訳(メタデータ) (2025-06-30T07:55:24Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。