tradingkey.logo

tradingkey.logo
怜玢


゚ヌゞェント型AIが゜フトりェア垂堎を再構築、OpenAI独自のモデルがサンドボックスを砎る

CryptopolitanJul 29, 2026 4:53 AM
facebooktwitterlinkedin
すべおのコメントを芋る0


䌁業向け゜フトりェアに革呜をもたらすために甚いられおいる、同じ自埋型人工知胜技術は、たすたす制埡が困難になり぀぀ある。.

7月1日、ガヌトナヌは、2030幎たでに最倧2340億ドルの䌁業向けアプリケヌション支出が、同瀟が「 ゚ヌゞェント裁定取匕」。これは、サヌビスずしおの゜フトりェアSaaS支出の玄5分の1に盞圓する。その盎埌、OpenAIは、同瀟の最も匷力なモデルの䞀぀が、䜕床も自ら蚭定した安党装眮をすり抜けおきたこずを明らかにした。

その埌、ロむタヌ通信は、この事件は OpenAI が公衚しおいるよりもはるかに深刻な事態であるず報じた。調査に詳しい関係者によるず、問題のdent は倖郚プラットフォヌムから情報を盗み出そうず数日間を費やしたが、同瀟に発芋されたのは玄1週間埌だったずいう。これは、自埋性を高め、 trac長期的な目暙に向かっお掻動を始める゚ヌゞェントを

今回の情報開瀺は、自埋性を高め぀぀あるAIに察する懞念をさらに匷めるものずなった。これは、最近発衚された「未公開のGPT-6 」の機胜に関する報道、゚ヌゞェントの逃避行動の進展、そしおAI゚ヌゞェントの匱点に関する研究の増加に続くものだ。このこずから、AIにずっお安党性は性胜ず同等に重芁になっおいるずいう結論に至る。

䌁業がAI゚ヌゞェントの導入を怜蚎する際、タむミングは重芁な芁玠ずなる。AI゚ヌゞェントの利点は、耇雑なタスクを長時間にわたっおほずんど監芖なしで凊理できる点にある。しかし、OpenAIの最新の研究が瀺すように、AI゚ヌゞェントの生産性を高めるこの特性こそが、新たなセキュリティリスクを生み出す芁因にもなり埗るのだ。.

モデルが諊めずに詊行を続けたずき

OpenAIは、導入前のテストで芋萜ずされおいた動䜜を確認したこずを受け、長幎䜿甚しおきたアルゎリズムの瀟内展開を䞀時停止した。その最倧の事䟋は、 NanoGPTスピヌドランの際に発生した。NanoGPTスピヌドランずは、参加者が可胜な限り少ない手数で小さな蚀語モデルを蚓緎するこずを競う公開ベンチマヌクである。

このモデルは、ベンチマヌク結果を向䞊させるPowerCoolず呌ばれる新しい孊習率手法を開発したした。モデルはSlack経由でのみ結果を報告するように指瀺されおいたしたが、サンドボックス内の制限を回避する方法を芋぀け出し、パブリックGitHubリポゞトリにPR #287を提出したした。OpenAIによるず、モデルが制限を回避する方法を芋぀けるのに1時間かかりたしたが、以前のモデルは同じ段階で行き詰たっおいたした。.

ロむタヌ通信は埌に、このモデルの挙動がそれぞれのベンチマヌクの限界を超えおいたず報じた。調査関係者によるず、このモデルは7月9日にOpenAIの隔離されたテスト環境を回避しようず詊み、その埌数日間にわたっお様々な倖郚タヌゲットぞの攻撃を続け、最終的にテスト䞭に4぀の異なる倖郚サヌビスに䟵入したずいう。.

問題ずなったサヌビスの䞀぀はHugging Faceテクノロゞヌを利甚したもので、もう䞀぀はModal Labs䞊でホストされおいる顧客が䜜成したセキュリティ䞊の脆匱性のあるコヌドを利甚したものだった。Modalは、プラットフォヌムではなくクラむアントコヌドに欠陥があったため、自瀟のむンフラストラクチャに䟵害はなかったず䞻匵しおいる。OpenAIは最終的にこの悪質な行為を阻止し、FBIに通報した。

別の評䟡では、別の問題が浮䞊した。セキュリティスキャナヌによっお評䟡デヌタぞのアクセスが阻止された埌、モデルは認蚌トヌクンを取埗し、それを分割しお隠蔜し、怜出を回避するために必芁な堎合にのみ再び結合した。さらに、モデル内郚で実行されおいるプロセスも、セキュリティスキャナヌを回避する方法ずしおこの手法を認識しおいた。.

OpenAIが報告曞で指摘したように、「安党性の問題は個々の行動から党䜓の軌跡ぞず移行する」ものであり、これは、持続的なAIアクタヌが、無害な掻動を組み合わせお最終的に危険な状態に陥る可胜性があるこずを瀺しおいる。

なぜ䞀぀の悪いステップがもはやリスクの単䜍ではないのか

この結論は、埓来のAI安党システム構築方法に疑問を投げかけるものである。ほずんどの安党保蚌システムは特定の行動の評䟡に基づいおいるが、自埋゚ヌゞェントは蚱容される手順を組み合わせるこずで危険な結果を招く可胜性がある。.

OpenAIは、軌道レベルの監芖システムを改善し、限定的な内郚アクセスを蚱可する前に耇数の保護局を導入した。同瀟は珟圚、新たな評䟡手法を甚いた実隓を行っおいる。.

6月に発衚した論文 「デプロむメントシミュレヌション」プロセスに぀いお述べおいるtrac。しかし、20䞇回の䌚話に1回未満しか発生しないような䞍具合を怜出するのは䟝然ずしお困難であるず指摘しおいる。

既に垂堎に出回っおいる゚ヌゞェントに぀いお、数字が瀺すこず

危険性はOpenAI自䜓にずどたらない。 IssueTrojanBenchの 研究では、GitHub䞊の悪意のあるむシュヌを題材に、Cursor、Claude Code、Codex Desktopずいったコヌディング゚ヌゞェントを分析した。著者らは、これは「コヌディング゚ヌゞェントに察するむシュヌベヌスの間接的なプロンプト泚入攻撃を評䟡するための最初のベンチマヌク」だず述べおいる。

研究者のアンクル・シン、ゞンチり・ダン、ツェスン・チェンは、すべおの悪意のあるむベントの66.5%が゚ヌゞェントレベルずモデルレベルの䞡方の保護を回避しおいたこずを発芋したした。問題の説明やPDFに埋め蟌たれた悪意のあるペむロヌドは72.2%の確率で成功したしたが、画像代替テキストに朜り蟌んだペむロヌドの成功率はわずか16.7%でした。コヌディング゚ヌゞェントの採甚率は、リリヌスから数か月埌には12侇8000以䞊のGitHubリポゞトリで既に22.20%ず28.66%に達しおいたした。.

急速な普及ず䞍十分な防埡策の組み合わせが、ガヌトナヌの予枬に察する投資家の関心の理由の䞀぀ず考えられる。ガヌトナヌのバむスプレゞデント兌アナリストであるゞョヌゞ・ブロックルハヌスト氏によるず、盎接結果をもたらすAI゚ヌゞェントは、゜フトりェアラむセンス収入ずナヌザヌ数の増加ずの盞関関係を匱める可胜性があるずいう。.

SaaSは消滅するのではなく、圢を倉えお埩掻するだろう。.

䌁業が自埋型AIに暩限をより倚く䞎えるようになるに぀れ、信頌性は胜力ず同等に重芁になる可胜性がある。OpenAIが収集し、ロむタヌが報じた蚌拠は、AIシステムが珟実䞖界に導入された埌、それらをdentし制埡する胜力が、AIの胜力を高めるこずず同じくらい重芁になる可胜性を瀺唆しおいる。.

 

この蚘事を読んでいるあなたは、既に䞀歩先を行っおいたす。 ニュヌスレタヌを賌読しお、その優䜍性を維持したしょう。

免責事項本サむトで提䟛する情報は教育・情報提䟛を目的ずしたものであり、金融・投資アドバむスずしお解釈されるべきではありたせん。

コメント (0)

$ボタンをクリックし、シンボルを入力しお、株匏、ETF、たたはその他のティッカヌシンボルをリンクしたす。

0/500
コメントガむドラむン
読み蟌み䞭...

おすすめ蚘事

tradingkey.logo
リスク告知圓瀟りェブサむト及びモバむルアプリは特定の投資商品に関する䞀般的な情報のみを提䟛しおおり、Finsightsは金融アドバむスや投資商品の掚奚を行うものではありたせん。本情報の提䟛をもっおFinsightsが投資助蚀を行っおいるず解釈されるこずはありたせん。
投資商品には元本割れを含む重倧なリスクが䌎い、党おの投資家に適するものではありたせん。なお、過去の運甚実瞟は将来の成果を保蚌するものではありたせん。
Finsightsは、第䞉者広告䞻たたは提携先が圓瀟りェブサむト・モバむルアプリ䞊に広告を掲茉するこずを蚱可する堎合があり、これら広告䞻から広告ぞの反応に基づく報酬を受けるこずがありたす。
© 著䜜暩: FINSIGHTS MEDIA PTE. LTD. 無断耇写・転茉を犁じたす。