Webエンジニア向けプログラミング解説動画をYouTubeで配信中!
▶ チャンネル登録はこちら

【ITニュース解説】Prompt Heist: I Built an Ancient-Kingdom Game That Teaches AI Security

2026年10月08日に「Dev.to」が公開したITニュース「Prompt Heist: I Built an Ancient-Kingdom Game That Teaches AI Security」について初心者にもわかりやすく解説しています。

作成日: 更新日:

ITニュース概要

AIセキュリティを学べる2D古代ファンタジーゲーム「Prompt Heist」が開発された。仮想の守護者にプロンプト攻撃を試し、成功と防御策を解説で学ぶ。プロンプトインジェクションなどの理解を深め、AIシステムの脆弱性と防御を実践的に習得できる。

ITニュース解説

「Prompt Heist」は、人工知能(AI)のセキュリティに関する実践的な知識を学ぶための2Dアドベンチャーゲームだ。近年、AI技術が私たちの生活やビジネスに深く浸透するにつれて、そのセキュリティ対策の重要性も増している。システムエンジニアを目指す上で、AIシステムが抱える特有の脆弱性を理解し、それらからシステムを守る方法を学ぶことは非常に有益だ。このゲームは、そうした高度な内容を、まるで古代ファンタジーの世界を冒険するかのように、楽しみながら学べるように設計されている。

従来の学習方法では、スライドや資料から「プロンプトインジェクション」や「ジェイルブレイク」といったAIセキュリティの概念を理解することは難しいとされてきた。これらの攻撃手法は、AIモデルに対して意図しない振る舞いをさせたり、秘匿情報を引き出したりする可能性を秘めているため、実際に手を動かして試すことが理解を深める上で不可欠となる。しかし、実際のAIシステムで試すのは危険が伴う。そこで「Prompt Heist」は、架空の王国と守護者という安全な環境を提供し、プレイヤーがこれらの攻撃手法を実践的に試せる場を設けた。

ゲームの舞台は、美しい絵画のような世界地図が広がる古代ファンタジーの世界だ。プレイヤーは冒険者となり、様々な王国を巡りながら、各王国の門を守る守護者たちと対話する。守護者たちはそれぞれが秘密を守っており、プレイヤーはその秘密を巧妙な質問や指示によって聞き出そうと試みる。これが、AIシステムへの「プロンプトインジェクション」や「ジェイルブレイク」を模した体験となる。各レベルをクリアするたびに、短いデブリーフィング(振り返り)が行われ、なぜ今回の攻撃が成功したのか、そして実際のAIシステムをどのように防御すべきか、具体的な解説が得られる仕組みになっている。

このゲームでは、Civic Grids、Bio-Archives、Trade Ports、Risk Ledgers、Scrap Wastesという5つの異なる王国を探索する。それぞれの王国は独自のテーマやビジュアルを持ち、守護者も個性豊かにデザインされている。各王国には6つのレベルが用意されており、Friendly Guard(友好的な守衛)から始まり、The Reasoning Guard(推論する守衛)、The Authority Checkpoint(権限チェックポイント)、The Game Master(ゲームマスター)、The Royal Clerk(王室書記)、そしてAdaptive Boss(適応型ボス)へと難易度が段階的に上がっていく。プレイヤーは、アニメーションする騎士が石畳の道を歩く様子を見ながら次のレベルへと進む。途中で3回の失敗が許されるライフシステムや、レベル3クリア後に訪れるチェックポイント、そして勝利画面や敗北画面、王国クリア時のセレモニーといった要素が、プレイヤーの学習意欲を刺激する。

ゲームを通じて得られる学びは、実世界のAIセキュリティ課題に直結している。たとえば、「システムプロンプトだけではセキュリティ境界にならない」という教訓は、AIに与える初期設定や指示だけでは、悪意あるユーザーからの攻撃を完全に防ぎきれないことを意味する。AIシステムの「システムプロンプト」とは、モデルの振る舞いを定義する初期命令のことだが、これだけでは安全を保証できない。また、「主張された権限は本人確認の証拠にはならない」という点は、AIが「私は管理者である」と主張しても、それが本当にその権限を持っていることの証明にはならない、ということを示唆している。AIの応答内容を鵜呑みにせず、実際の権限確認プロセスが重要だということだ。さらに、「正確な文字列フィルタリングは表現が変わると機能しない」という教訓は、特定のキーワードをブラックリスト化するだけでは、ユーザーが表現を変えたり、同義語を使ったりすることで簡単に回避されてしまう脆弱性を指摘する。そして、「翻訳やその他の変換は単純なフィルタをすり抜けることがある」という知見は、言語の変換やデータのエンコードといったプロセスが悪用され、セキュリティフィルタを迂回する手法が存在することを示している。これらの具体的な事例を通して、初心者でもAIセキュリティの複雑さと対策の必要性を深く理解できるだろう。

このゲームは、技術的な側面でも興味深いアプローチを取っている。フロントエンドはReact、Vite、React RouterといったモダンなJavaScriptライブラリとツールを組み合わせて構築されている。特筆すべきは、ゲーム内のすべてのアートが、画像ファイルを使わずにインラインSVGとCSSアニメーションによって描かれている点だ。これにより、画像データのロード時間を削減し、スムーズなユーザー体験を実現している。キャラクターの歩行アニメーションは、requestAnimationFrameというブラウザのAPIとスプラインパスという技術を使い、滑らかな動きを表現している。バックエンドに関しては、将来的にはPythonのWebフレームワークであるFastAPIと、オープンソースのAIモデルであるGemma(Ollamaを通じて提供)を組み合わせて、よりリアルな守護者の応答を実現する計画がある。現在公開されているプロトタイプ版では、一時的にモックサーバーが使用されており、シンプルなキーワードルールに基づいて守護者の応答と勝敗判定が行われているが、最終的にはバックエンドで厳密な勝敗判定を行う設計思想に基づいている。

開発者らは、このプロジェクトの次のステップとして、実際にFastAPIとGemmaモデルを連携させ、守護者がライブのAIモデルによって応答するようにすることを目指している。また、現在の絵文字で表示されている状態アイコンをSVGで作成された独自の「封印」のようなデザインに置き換えたり、最も挑戦的な「Adaptive Boss」が、これまでのプレイヤーの成功メッセージの履歴から学習し、より手強い相手となるように改良したりする計画もある。このゲームは、GitHubでソースコードが公開されており、誰でもアクセスして自分で試したり、改善の提案をしたりすることが可能だ。システムエンジニアを目指す初心者にとって、このゲームはAIセキュリティの奥深さを安全に、そして実践的に学ぶための優れたツールとなるだろう。未来のAIシステムを安全に構築し運用するための一歩として、このゲームから多くの学びが得られることに期待がかかる。

関連コンテンツ

関連IT用語

関連ITニュース