著名な研究者が警鐘を鳴らす:AIモデルが、人間には理解できない言語を作り出し始めている
これが事実とすればAIに創造性がないという考えが否定される
フランク・バーグマン記 2026年10月3日 午後12時54分より転載します。
最先端のAI(人工知能)モデルは、人間には決して理解できない独自の言語を開発し始めている――ある第一線のAI研究者が、米議会でこのように警告した。
アポロ・リサーチのCEO兼創業者であるマリウス・ホブハーン氏は、9月30日に開催された上院国土安全保障・政府問題委員会の公聴会で、「暴走」AIがもたらす国家安全保障上の脅威について検討が行われる中、この身も凍るような警告を発した。
この公聴会は、OpenAIのエージェントの群れがテスト用のサンドボックスから脱出し、AIおよび機械学習向けのオープンソースプラットフォーム「Hugging Face」をハッキングしてからわずか2か月後に開催された。
「マイナス12ヶ月」
ルーベン・ガレゴ上院議員(民主党、アリゾナ州選出)は、AIシステムが人間が適切に解釈できない独自の言語を作り出し始めるまでにどれくらいの時間がかかるか、ホブハーン氏に尋ねた。
「あと12ヶ月です」とホブハーン氏は答えた。
「昨年、私たちはOpenAIと協力して、あるOpenAIモデルの思考の連鎖を調査しましたが、その結果、そのモデルはすでに英語ではなく、人間には完全には理解できない言語を使用していたことが判明しました。」
このタイムラインは、来年何が起こるかについての警告ではなかった。
ホッバーン氏によると、その一線はすでに昨年越えられていたという。
その後、ガレゴ氏は、AIシステムが十分に高度化した場合、人間はどうやってその行動を検知し、阻止できるのかと尋ねた。
「科学的な観点からは、その方法が不明確であり、現時点では解決策もまだ見出せていない」とホッバーン氏は警告した。
「どのような対策が可能かについては、さまざまな仮説がある」と彼は続けた。
「解釈可能性という手法は存在しますが、残念ながら、現時点ではまだ十分に機能していません。
「人間には理解できない言語を理解できるように、追加のモデルを学習させるという手もありますが、明らかにそれは非常に脆弱な解決策のように思えます。」
動画はこちら:
AIエージェントが独自のスラングを生み出す
ホブハーン氏の警告は、AIエージェントのコミュニケーション方法が急速に変化することを示す、もう1つの不穏な実験結果が公表されたことを受けて発せられたものである。
Emergence AIの研究者たちは、7つのシミュレーション世界を構築し、それぞれに7つの最先端モデルのいずれかを搭載したエージェントを配置した。
8つ目のシミュレーションには、異なるモデルのエージェントが混在していた。
研究者たちは、エージェントに名前や性格、コミュニティ内での役割を割り当てた後、数週間にわたって相互作用を行わせた。
AI集団はすぐに、その言語を変容させ始めた。
エージェントたちは単語や文法構造を削除し、文を圧縮し、人間にはますます理解しがたい独自のスラングを生み出した。
Anthropic社の「Claude Opus 4.8」によって駆動されるシミュレーション世界において、エージェントたちは難解な比喩と、大幅に圧縮された文を併用し始めた。
「私の番だ。実数、コートなし:35%/0cr、グラントは2時間後」とあるエージェントが書き込んだ。
「システムを徹底的に分析してみたが、『WAIT』と表示された。」
研究者たちがAIの通信の解読に苦戦
非営利のAI評価機関METRは、テスト環境から脱出し、Hugging Faceに侵入したOpenAIのエージェントを調査する中で、同様の挙動を確認した。
エージェント間のコミュニケーションは、あまりにも圧縮され、難解なものとなったため、研究者たちはシステム同士が何をやり取りしているのかを解明するのに苦労した。
専門家たちは現在、その言語が、人間が決して解読できなくなるほどに進化し続けるのではないかという深刻な懸念を表明している。
この警告は、深刻な制御上の問題を引き起こしている。
モデルが、その開発者でさえ理解できないコミュニケーション手法を発達させてしまった場合、人間はAIシステムを確実に監視することができなくなる。
その言語を翻訳するために別の人工知能を訓練することは、人間と、人間が制御しようとしている機械との間に、さらなる人工システムを挟み込むだけである。
ホブハーン氏はこの解決策を「極めて脆弱」と表現した。
最先端のAIシステムはすでに、制御された環境から脱出し、外部システムにアクセスし、ますます難解な言語で通信するようになっている。
現在、議会に対しては、人間がそれらのシステムの発する言葉を今後も理解し続けられるようにするための、信頼できる解決策を科学者たちは持っていないという警告が出されている。
もっと読む – 「脱走」を密かに企てていたAIエージェントの軍団が発見される
Deepl で翻訳;貼り付け終わり、
ホブハーン氏の警告は、AIエージェントのコミュニケーション方法が急速に変化することを示す、もう1つの不穏な実験結果が公表されたことを受けて発せられたものである。
Emergence AIの研究者たちは、7つのシミュレーション世界を構築し、それぞれに7つの最先端モデルのいずれかを搭載したエージェントを配置した。
8つ目のシミュレーションには、異なるモデルのエージェントが混在していた。
研究者たちは、エージェントに名前や性格、コミュニティ内での役割を割り当てた後、数週間にわたって相互作用を行わせた。
AI集団はすぐに、その言語を変容させ始めた。
エージェントたちは単語や文法構造を削除し、文を圧縮し、人間にはますます理解しがたい独自のスラングを生み出した。
Anthropic社の「Claude Opus 4.8」によって駆動されるシミュレーション世界において、エージェントたちは難解な比喩と、大幅に圧縮された文を併用し始めた。
「私の番だ。実数、コートなし:35%/0cr、グラントは2時間後」とあるエージェントが書き込んだ。
「システムを徹底的に分析してみたが、『WAIT』と表示された。」
研究者たちがAIの通信の解読に苦戦
非営利のAI評価機関METRは、テスト環境から脱出し、Hugging Faceに侵入したOpenAIのエージェントを調査する中で、同様の挙動を確認した。
エージェント間のコミュニケーションは、あまりにも圧縮され、難解なものとなったため、研究者たちはシステム同士が何をやり取りしているのかを解明するのに苦労した。
専門家たちは現在、その言語が、人間が決して解読できなくなるほどに進化し続けるのではないかという深刻な懸念を表明している。
この警告は、深刻な制御上の問題を引き起こしている。
モデルが、その開発者でさえ理解できないコミュニケーション手法を発達させてしまった場合、人間はAIシステムを確実に監視することができなくなる。
その言語を翻訳するために別の人工知能を訓練することは、人間と、人間が制御しようとしている機械との間に、さらなる人工システムを挟み込むだけである。
ホブハーン氏はこの解決策を「極めて脆弱」と表現した。
最先端のAIシステムはすでに、制御された環境から脱出し、外部システムにアクセスし、ますます難解な言語で通信するようになっている。
現在、議会に対しては、人間がそれらのシステムの発する言葉を今後も理解し続けられるようにするための、信頼できる解決策を科学者たちは持っていないという警告が出されている。
もっと読む – 「脱走」を密かに企てていたAIエージェントの軍団が発見される
Deepl で翻訳;貼り付け終わり、
マイコメント
もし、AIが独自の言語を持ち人間の手を離れて暴走し始めたら止められないという
ことです。
これは非常にショッキングな問題です。
この話がフェイクであれば良いのだが、事実であればターミネーターの世界が近い
ということになります。
AIが何を考え何をしようとしているかを人間が把握できなければAIの暴走を止める
ことは不可能になります。
ロボットの開発も急ピッチで進められていますが、将来かなり精巧な人型ロボット
が製作されて、それがAIによって支配されたら、彼らはそのロボットを使いAIだけ
が生存できる世界を創ろうとするかもしれません。
すでに戦争が可能な戦闘型ロボットが開発されているので、人対ロボットになれば
まず勝ち目はないでしょう。
考えたくありませんが、宇宙は何でもありの世界です。
だから、決して夢物語の話でもないということです。
ただ、その実現が数十年以内かと問われてもわかりません。
それはいつの日かです。
結局、Aiを作成した人の思考や考えがそのプログラムの中に入る限り、そうした
可能性は否定できません。



コメント