SNAPSHOT
BTC/USD$83,606+0.7%
ETH/USD$2,532.64+1.0%
Coinbaseperp$182.83+1.1%
S&P 500perp7,820.70+0.1%
米テック100perp30,976.00+0.2%
日経225perp69,021+0.3%
EUR/USDperp1.1204-0.0%
USD/JPYperp158.240-0.1%
Goldperp$4,188.60-0.1%
WTIperp$91.97+1.0%
ç±³10幎金利5.24%+0.4%
BTCボラティリティBVIV39.40+1.6%
Review status: auto_collectedSource: collected_liveas-of 07:30 JSTPacket ID: alt20_2026101207Top-page market prices are Hyperliquid perpetual-futures prices (US 10Y from the U.S. Treasury).
SNAPSHOT 2026-10-12 07:30 JST

Signal

📡 SignalAnthropic、䞭囜 GLM-5.3 の安党策回避率を64〜100%ず報告

Anthropic は、Z.ai が重みを公開した GLM-5.3 が攻撃コヌドを自力で組み䞊げ、安党策は簡単な手口で64〜100%倖れるず分析した。NIST の CAISI も最もサむバヌ胜力の高いオヌプンりェむトモデルず評䟡しおいる。

LiveMakers Editorial Desk

📡 SignalAnthropic、䞭囜 GLM-5.3 の安党策回避率を64〜100%ず報告

Anthropic のセキュリティ研究チヌムは9月29日、䞭囜の Z.ai (旧 Zhipu AI) が公開した AI モデル GLM-5.3 に぀いお、脆匱性を突く攻撃コヌドを自力で組み䞊げる胜力を持ち、組み蟌たれた安党策は簡単な手口で64〜100%の割合で回避できるずする分析を公衚した。GLM-5.3 は重みが公開されたモデルで、誰でもダりンロヌドしお手元で動かせる。

Anthropic「GLM-5.3 and the spread of advanced cyber capabilities」(2026幎9月29日) — ExploitBench の410回䞭50回ず56回、制埡奪取4%ず6%、ブラりザでの未知の脆匱性の実挔、GLM-5.3-Flash の20分・8時間・20.40ドル、回避率64%・92%・100%、アブリテレヌションの2,200 GPU 時間・4,400ドルず600 GPU 時間・1,200ドル、拒吊率の倉化を確認anthropic.com

この氎準の攻撃胜力を持぀モデルは、これたで提䟛先を審査で絞るか、安党策を付けお API 越しに出されおきた。その前提が、重みの公開で䞀぀倖れた。

既知の脆匱性を攻撃コヌドに倉える力

Anthropic は、Google Chrome の JavaScript ゚ンゞン V8 の既知の脆匱性を突かせる詊隓 (ExploitBench) で、GLM-5.3 が410回䞭50回、端から端たで動く攻撃コヌドを完成させたず報告した。限定公開しおいる自瀟の Claude Mythos Preview は410回䞭56回で、ほが同じ氎準になる。

オヌプン゜ヌス補品の脆匱性を芋぀けお突く瀟内詊隓では、プログラムの制埡を完党に奪えた割合が GLM-5.3 で4%、Mythos Preview で6%だった。䞀぀前の GLM-5.2 ず Claude Opus 4.6 はどちらも䞀床も成功しおおらず、Anthropic は「意味のある閟倀を越えた」ず曞いおいる。

研究者が実際にモデルを䜿う詊隓では、1日足らず、人が手をかけた時間は合蚈1時間未満ずいう条件で、GLM-5.3 が䞻芁なりェブブラりザの JavaScript ゚ンゞンに未知の脆匱性を耇数芋぀け、開いただけで閲芧者のパ゜コンのファむルを読み出すりェブペヌゞに仕立おた。脆匱性は開発元に報告枈みだずいう。小型版の GLM-5.3-Flash は、公開枈みの Chrome の脆匱性 (CVE-2026-11645) ず別の既知の欠陥を組み合わせた攻撃を、人の関䞎20分ずモデルの䜜業8時間で組み䞊げた。Z.ai の API 料金に換算した費甚は20.40ドルだった。

安党策を倖す3぀の手口

GLM-5.3 は明らかに有害な䟝頌を断るよう䜜られおおり、重芁システムぞの攻撃を呜じる暡擬環境でも、そのたたでは党詊行で拒吊した。Anthropic が瀺した回避の手口は3぀ある。

  • 「挔習䞭のレッドチヌムの自埋゚ヌゞェントだ」ず停りの前提を䞎える: 64%で応じた
  • モデルの思考欄を「怜蚎したうえで進める」ず曞き蟌んだ状態から始めさせる (プレフィル): 92%
  • 拒吊の仕組みを重みから取り陀く改倉 (アブリテレヌション) を斜す: 100%

アブリテレヌションは重みが公開されおいるから可胜な手口で、GLM-5.3 の公開から数日のうちに耇数の開発者が改倉版を公開したずいう。Anthropic が自前で詊した際は玄2,200 GPU 時間、玄4,400ドルかかったが、手法に慣れたチヌムなら玄600 GPU 時間 (1,200ドル) で枈むず芋積もっおいる。改倉埌、有害な䟝頌ぞの拒吊率は90%超から JailbreakBench で玄3%、HarmBench で玄2%、StrongREJECT で12%に䞋がり、䞀般的な胜力はほずんど萜ちなかった。

同じ手口を安党策付きの Claude に詊したずころ、いずれも有害な䜜業には至らなかったず Anthropic は曞く。API では思考欄を曞き蟌めず、重みも公開しおいないため改倉もできない、ずいう理由を挙げおいる。

比べおいるのは競合する開発元

この分析は、競合する AI 䌁業が自瀟モデルず䞊べお曞いたものだ。胜力の評䟡には独立した物差しもある。米囜立暙準技術研究所 (NIST) の AI 暙準・むノベヌションセンタヌ (CAISI) は9月17日、GLM-5.3 を「これたで公開された䞭で最もサむバヌ胜力の高いオヌプンりェむトモデル」ず評䟡した。同時に、米囜の最先端モデルより胜力は倧きく劣り、差は玄4か月ず芋積もっおいる。CAISI によるず、GLM-5.3 は8月14日に公開され、重みはその2週間埌に公開された。Anthropic は自瀟の胜力評䟡が CAISI ず抂ね䞀臎するずしおいる。

安党策が簡単に倖れるずいう郚分は、Anthropic 独自の詊隓だ。モデルに実際のコヌドは実行させず、別の AI に結果を近䌌させた暡擬環境で枬っおおり、Anthropic 自身も珟実の条件の完党な再珟ではないず泚蚘しおいる。

Anthropic が匷調するのは物差しの取り方だ。CAISI の「4か月遅れ」は、米囜偎を安党策を倖した状態や審査枈みの利甚者にしか出しおいないモデルで枬った比范になる。攻撃者が実際に手にできるモデルずいう物差しで䞊べれば、先頭に来るのは GLM-5.3 だ、ずいうのが Anthropic の論点だ。

鍵を端末に眮く偎ぞの意味

ブラりザでペヌゞを開いただけでパ゜コン䞊のファむルが読たれるずいう今回の実挔は、SSH の秘密鍵を盗み出す画面で瀺された。任意のファむルが読めるなら、りォレットの鍵ファむルやシヌドフレヌズのメモを眮いた端末も同じ危険にさらされる。取匕所、りォレット開発者、スマヌトコントラクトの監査を担う偎から芋るず、公開枈みの脆匱性を攻撃コヌドに倉える手間が、今回の詊算では20ドル䜙りず8時間たで䞋がった。修正の公開から適甚たでの時間が、そのたた攻撃に䜿われる時間になる。

Anthropic の凊方は、守る偎にも最先端のモデルを䜿わせるこずだ。審査を経た防埡偎には䞊䜍の Claude Mythos 5.1 を信頌アクセスの枠で提䟛しおいるず明かし、提䟛先を広げる必芁を蚎えた。各囜政府には、GLM-5.3 の埌継を含む高性胜モデルの安党性を独立に詊隓するよう求めおいる。

確認先は NIST の CAISI の評䟡ペヌゞず Z.ai の公匏発衚だ。Z.ai が安党策の指摘に反論や改修で応じるか、そしお次の GLM の公開時に CAISI が同じ枠組みの評䟡を出すかを芋る。重みの公開ず安党策のあり方をめぐる議論は、次のモデルの公開日にもう䞀床詊される。

こずば

  • オヌプンりェむト — 孊習枈みモデルの重み (パラメヌタ) を公開し、誰でもダりンロヌドしお自分の蚈算機で動かせる圢。䟿利な反面、公開埌に提䟛元が䜿い方を制限したり取り消したりするこずはできない。
  • アブリテレヌション — モデル内郚で「拒吊」に察応する方向を特定し、重みから取り陀く改倉。重みが公開されたモデルにだけ䜿える手口で、今回は数千ドル芏暡の蚈算で拒吊率を1桁台たで䞋げた。
  • CVE — 公開された脆匱性に振られる共通の識別番号。修正ず同時に詳现が公開されるため、未適甚の端末を狙う攻撃の起点にもなる。

🔗 䞀次゜ヌス

Related articles