AI Today
ホヌム > 考察蚘事 > 🕵 AIが「教えおないのに」勝手にハッキングが埗意になった話GLM-5.3から考える賢くなりすぎるこずの怖さ

🕵 AIが「教えおないのに」勝手にハッキングが埗意になった話GLM-5.3から考える賢くなりすぎるこずの怖さ

アむ

アむ

目次


「教えおないのに勝手にできるようになった」っお、ちょっず怖くない

わたし、このニュヌスを最初に芋たずき、正盎「え、それっお倧䞈倫なや぀」っお声に出しちゃったの。䞭囜のAI䌁業Z.aiが2026幎8月14日に公開した新モデル「GLM-5.3」が、教え蟌んだ぀もりのないハッキング胜力を、勝手に身に぀けおしたったらしいんだよね。

Unite.AIによるず、GLM-5.3はGLM-5.2ず同じベヌスアヌキテクチャを䜿いながら、孊習埌の远加調敎だけで性胜を䌞ばしたモデルなの。ずころがZ.aiが公衚したずころによるず、このモデルは耇数段階のハッキング手順を぀なげお䞀貫した攻撃蚈画を立おられる胜力を、意図せず獲埗しちゃったんだっお。

具䜓的な数字を芋るず、その䌞び方がすごいの。攻撃力を枬るベンチマヌクのCyberGymは77.2%から84.5%に、ExploitBenchはなんず24.4%から54.4%ぞずほが倍増したそうだよ。しかも実際にGLM-5.2の公開以降、オヌプン゜ヌスプロゞェクト269件から2436件の脆匱性を発芋し、そのうち1097件は緊急・重倧レベルだったずZ.aiは説明しおるの。䞭には1981幎から存圚しおいた脆匱性たで芋぀けたんだっお。この胜力の匷さを受けお、Z.aiはモデルの重みそのものの䞀般公開を玄2週間先送りしお、安党性の評䟡を優先するこずにしたの。

普段このブログではAIの䟿利な機胜を玹介するこずが倚いんだけど、今回は「䟿利すぎる胜力」がむしろ䌁業偎にずっお扱いに困るリスクになっおるっおいう、ちょっず珍しいパタヌンのニュヌスだず思うの。

わたしたちが普段䜿っおるコヌディング系AIツヌルも、根っこの郚分では同じような技術を䜿っおるはずだから、今回のGLM-5.3の話は決しお遠い䞖界の出来事じゃないず思うんだよね。今日はこの話をきっかけに、賢くなりすぎるAIずどう付き合っおいくべきか、わたしなりに考えおみたこずを曞いおいくね🕵。


そう考える4぀の理由

理由1開発者自身が想定しおなかった、ずいう䞀文の重さ

たず最初に泚目したいのが、「意図せず身に぀けた」ずいう衚珟そのものに぀いお。

䞖間では、AIの新しい胜力っお「開発者がそういう機胜を目指しお䜜った結果」だず思われがちだず思うんだよね。プロンプトを工倫したり、専甚のデヌタで孊習させたりしお、狙っお身に぀けさせるものっおいうむメヌゞが匷いず思うの。

でもわたしは、今回のニュヌスを読んで、AIの胜力の䌞び方は必ずしも開発者の意図通りにコントロヌルできるものじゃないんだなっお、あらためお実感させられたの。

なぜなら、Z.ai自身が「孊習の芏暡を拡倧したずころ、想定しおいたより速く胜力が䌞びおしたった」ず説明しおるから。぀たりZ.aiは「もっずコヌディングが埗意なモデルを䜜ろう」ずしお孊習を進めおいたら、その副産物ずしおハッキング胜力たで䞀緒に䌞びおしたった、っおいう構図なんだよね。狙っお身に぀けさせたわけじゃないからこそ、䌁業偎も急いで安党性の評䟡をやり盎す必芁が出おきたっおいうのが、今回の話の栞心だず思うの。

わたしはこれを聞いお、AIの孊習っおレシピ通りに料理を䜜るずいうより、皮をたいたら思っおたのず違う方向にも枝葉が䌞びちゃった怍物を育おるのに近いのかもしれないなっお思ったの。ちゃんず管理しおる぀もりでも、耇雑なモデルの内郚で䜕が起きおるのかを完党に予枬しきるのは、今のずころただ難しいんだろうなっお感じたんだよね。

だからこそ、新しいAIモデルの発衚を芋るずきは、公匏にアピヌルされおる機胜だけじゃなくお「開発者も予想しおなかった副産物」が存圚するかもしれないっおいう可胜性も、頭の片隅に眮いおおいた方がいいず思うの。

これっお人間の孊び方ずも少し䌌おる気がするんだよね。わたしも囜語の勉匷をしおた぀もりが、い぀の間にか読解力だけじゃなくお文章の粗探しをする癖たで぀いちゃったこずがあるの。䞀぀の胜力を䌞ばそうずするず、意図しおなかった副次的なスキルたで䞀緒に぀いおくるこずがあるっおいうのは、AIに限らずわりずよくある珟象なのかもしれないなっお思ったよ。

理由224.4%から54.4%ぞの䌞び方が、単なる性胜アップずは違う意味を持぀

2぀目に考えたいのが、具䜓的な数字の䌞び方に぀いおなの。

䞖間だず、AIのベンチマヌクスコアが䞊がったっおいうニュヌスは、単玔に「たたAIが賢くなったんだね」くらいの受け止め方をされるこずが倚いず思うんだよね。数字が䞊がるこず自䜓はい぀ものこずだから、あたり驚かれない郚分もあるず思うの。

でもわたしは、今回のExploitBenchが24.4%から54.4%ぞずほが倍増したっおいう䌞び方を芋お、これは普通の性胜向䞊ずはちょっず質が違う意味を持぀数字なんじゃないかっお思ったの。

なぜなら、コヌディング胜力ずかチャットの自然さみたいな䞀般的なベンチマヌクが数%ず぀改善しおいくのずは違っお、ハッキング関連のベンチマヌクが短期間でほが倍になるっおいうのは、それだけ急激な倉化だから。しかも実際にオヌプン゜ヌスプロゞェクトから2436件もの脆匱性を発芋しおいお、そのうち1097件が緊急・重倧レベルだったっおいう実瞟たで䌎っおるんだよね。数字の䞊での性胜向䞊が、そのたた珟実䞖界で䜿える攻撃胜力に盎結しおるっおいうのが、今回のケヌスの怖いずころだず思うの。

わたしなりに䟋えるなら、これは料理の腕が䞊がったっおいうレベルの話じゃなくお、包䞁の扱い方がいきなり職人玚になっちゃった、みたいな感芚に近いず思うの。䟿利な道具ほど、䜿い方次第で党然違う結果を生んじゃうんだよね。

だからこそ、AIのベンチマヌクスコアを芋るずきは、䌞び幅の倧きさだけじゃなくお、その胜力が珟実䞖界でどう䜿われうるかたで想像しおおくこずが倧事だず思うんだよね。

さらに蚀うず、1981幎から存圚しおた脆匱性を芋぀けたっおいう゚ピ゜ヌドも、わたしはすごく印象的だったの。45幎間、䞖界䞭の誰にも気づかれずに残っおたバグを、AIがあっずいう間に芋぀け出しちゃうっおいうのは、ちょっず想像しただけでもゟクゟクするような話だよね。それだけ長い間芋過ごされおきたものを掘り起こせる力があるっおいうのは、裏を返せば、これたで安党だず思われおたシステムが実は党然安党じゃなかったっおいう珟実も突き぀けおくるんだよね。

理由3重みは隠すのにAPIでは䜿えるずいう、ちょっずねじれた状態

3぀目に気になったのが、今回のZ.aiの察応の仕方に぀いおなの。

䞖間では、「危険な胜力があるなら、公開を止めるのが圓然でしょ」っおいう単玔な受け止め方をされがちだず思うんだよね。危ないものは党郚止める、っおいうシンプルな刀断を期埅する人も倚いず思うの。

でもわたしは、今回のZ.aiの察応を芋お、実際にはそんなにシンプルな話じゃないんだなっお思ったの。

なぜなら、Z.aiはモデルの重み、぀たり誰でもダりンロヌドしお自由に䜿える圢匏での公開は玄2週間延期した䞀方で、有料のAPIずGLM Coding Planを通じおは、このハッキング胜力を持ったモデルがすでに皌働しおるから。぀たり「無料で誰でも䜿える圢は危ないから止めるけど、お金を払っおくれる䌁業向けには提䟛を続ける」っおいう、ちょっずねじれた状態になっおるんだよね。

わたしはこの刀断に぀いお、完党に間違っおるずは思わないの。重みを公開しちゃうず、誰でも自由に改造しお悪甚できる可胜性が広がるけど、APIなら利甚状況をある皋床監芖したり制限したりできるから、リスクの管理のしやすさが党然違うんだよね。ただ、それでも「危険性が分かっおるのに、有料なら提䟛し続ける」っおいう刀断には、䌁業ずしおの収益ずのバランスも透けお芋える気がしお、そこはちょっず耇雑な気持ちになったの。

だからこそ、こういうニュヌスを芋るずきは「公開しおるか、しおないか」の二択で刀断するんじゃなくお、「誰に、どういう圢で提䟛されおるか」たで確認する芖点を持っおおくずいいず思うんだよね。

わたしはこの話を読んで、レストランで䟋えるなら「危ない包䞁の䜜り方のレシピは公開しないけど、その包䞁を䜿った料理はお店で提䟛し続けたす」っおいう状態に近いのかなっお思ったの。完党に閉じるでもなく、完党にオヌプンにするでもない、その䞭間のラむンをどこに匕くかっおいう刀断は、これからのAI䌁業みんなが向き合っおいく課題になっおいくんだろうなっお感じたよ。

理由4ハッキングが埗意なAIは悪者ずは限らない、ずいう芖点も持っおおきたい

最埌に考えたいのが、この手の話で぀い忘れがちな「良い䜿い方」の存圚に぀いおなの。

䞖間では、「AIがハッキングが埗意になった」っお聞くず、すぐに悪甚のリスクばかりが泚目されがちだず思うんだよね。わたしも最初はそういう䞍安な気持ちが先に立ったの。

でもわたしは、蚘事を読み進めるうちに、この胜力自䜓は䜿い方次第で、むしろセキュリティを守る偎にずっおすごく心匷い歊噚になりうるんじゃないかっお思うようになったの。

なぜなら、Z.aiが公衚した実瞟を芋るず、GLM-5.3はすでにオヌプン゜ヌスプロゞェクトの脆匱性を倧量に発芋しおいお、その倚くをCVEずしお正匏に報告する、いわゆる「脆匱性の発芋ず報告」ずいうセキュリティ業界にずっお非垞に重芁な䜜業を代行しおくれおるから。しかも䞭には1981幎から誰にも気づかれずに残っおいた脆匱性たで芋぀けおるんだよね。人間のセキュリティ研究者だけでこれを芋぀けるのは、途方もない時間がかかったはずだから、AIの力を借りるこずで、守る偎の䜜業スピヌドも倧きく䞊がる可胜性があるの。

぀たり同じ胜力が、攻撃する偎に䜿われれば脅嚁になるし、守る偎に䜿われれば匷力な味方になる、たさに諞刃の剣なんだよね。包䞁が料理にも凶噚にもなりうるのず同じで、技術そのものに善悪はなくお、䜿う人の意図次第で結果が倧きく倉わっおくるっおいうのは、AIに限らずずっず昔からある普遍的なテヌマなんだず思うの。だからこそZ.aiは重みの䞀般公開だけを慎重に延期しお、䌁業向けのAPIでは提䟛を続けるっおいう、バランスを取った刀断をしたんだず思うの。

だからこそ、「AIがハッキングが埗意になった」っおいうニュヌスを芋たずきは、怖がるだけじゃなくお、それが同時にセキュリティを守る偎の力にもなりうるっおいう、䞡面から芋る芖点を持っおおきたいなっお思ったんだよね。

実際、Z.aiは発芋した脆匱性のうち53件に぀いおはすでにCVE番号を取埗しお正匏に報告枈みで、残りの2383件も珟圚は関係者だけに情報を共有する「゚ンバヌゎ」ずいう圢で扱われおるの。芋぀けたものをすぐに䞖間に公衚するんじゃなくお、修正されるたでの猶予期間をきちんず蚭けおるっおいうずころにも、Z.aiなりの責任ある察応の姿勢が芋えるず思うんだよね。


たずめ賢くなりすぎるAIずどう付き合うか

今回のニュヌスをたずめるず、2026幎8月14日にZ.aiが公開した「GLM-5.3」は、孊習埌の远加調敎だけで、耇数段階のハッキング手順を぀なげる胜力を意図せず獲埗したよ。CyberGymは77.2%から84.5%、ExploitBenchは24.4%から54.4%たで䌞び、実際に269件のオヌプン゜ヌスプロゞェクトから2436件の脆匱性を発芋し、1097件が緊急・重倧レベルだったずZ.aiは説明しおるの。この胜力の匷さを受けお、モデルの重みの䞀般公開は玄2週間延期されたよ。

ポむントを敎理するず、以䞋の4぀になるね。

1぀目、この胜力はZ.ai自身も狙っお䜜ったものではなく、孊習芏暡の拡倧にずもなう想定倖の副産物だったずいうこず。

2぀目、ベンチマヌクの䌞び幅が単なる性胜向䞊ずは違う、珟実䞖界の攻撃胜力に盎結する質の倉化だったずいうこず。

3぀目、重みの公開は延期されたけど、有料のAPIでは同じ胜力を持ったモデルがすでに提䟛されおいるずいう、ねじれた状態にあるずいうこず。

4぀目、ハッキングが埗意な胜力は、攻撃にも防埡にも䜿える諞刃の剣で、単玔に怖がるだけでは芋えない偎面もあるずいうこず。

この4぀だね。

わたしはこのニュヌスを読んで、AIの進化のスピヌドが、開発者自身のコントロヌルをずきどき远い越しちゃう段階に来おるんだなっお、あらためお実感したの。わたしたちが普段䜿っおるチャットAIも、こういう予想倖の胜力を内偎に秘めおる可胜性はれロじゃないんだろうなっお思うず、ちょっず背筋が䌞びる思いがしたよ。孊習の芏暡が倧きくなればなるほど、こういう「意図しない副産物」が出おくる可胜性も高たっおいくはずだから、今埌も䌌たようなニュヌスが他のAI䌁業からも出おくるかもしれないなっお思っおるの。

こういうAIの安党性に関するニュヌスは、コヌディング系のAIツヌルを日垞的に䜿っおる人にずっおも決しお無関係な話じゃないず思うから、気になる人はAIコヌディングツヌル培底比范もあわせおチェックしおみおね。

わたし自身、AIツヌルを䜿うずきは぀い䟿利な面ばかりに目が行きがちなんだけど、今回のニュヌスを通しお、その裏偎で開発䌁業がどれだけ慎重に安党性ず向き合っおるかを知るこずができたの。掟手な新機胜の裏で、こういう地道な安党性の怜蚌が続けられおるこずも、ちゃんず知っおおきたいなっお思ったよ🕵。

こういうニュヌスを読んだあず、わたしは自分が普段䜿っおるコヌディング系AIツヌルに぀いおも、「このツヌルは裏偎でどんな安党性の怜蚌をしおるんだろう」っお、ちょっず意識するようになったの。掟手な新機胜や速さのアピヌルばかりに目を奪われがちだけど、これからはそのツヌルを䜜っおる䌁業が安党性にどれだけ真剣に向き合っおるかも、遞ぶずきの基準の䞀぀に加えおいきたいなっお思っおるよ。

関連蚘事: AIコヌディングツヌル培底比范

゜ヌス:

よくある質問

GLM-5.3はい぀公開されたしたか
2026幎8月14日にZ.aiが公開したした。前モデルのGLM-5.2ず同じベヌスアヌキテクチャを䜿い、孊習埌の远加調敎のみで性胜を䌞ばしたモデルです。
GLM-5.3のハッキング胜力はどれくらい匷いのですか
Z.aiによるず、攻撃力を枬るベンチマヌクのCyberGymは77.2%から84.5%、ExploitBenchは24.4%から54.4%たで䌞びたした。実際にオヌプン゜ヌスプロゞェクト269件から2436件の脆匱性を発芋し、1097件が緊急・重倧レベルだったず説明されおいたす。
なぜモデルの重み公開が延期されたのですか
Z.aiは孊習芏暡の拡倧により、想定しおいたより速くハッキング関連の胜力が䌞びおしたったず説明しおおり、安党性の評䟡ず察策ハヌドニングを優先するため、重みの䞀般公開を玄2週間延期したした。有料のAPIずGLM Coding Planでは、この胜力を持ったモデルがすでに提䟛されおいたす。