AIToday
大規模言語モデルAIコーディングオープンソースAIZenn AI/ML掲載日時: 2026年10月3日 22:00

AI Security LabがOllamaベースのLLM実験環境をGitHubで公開

LINEで送る
AI Security LabがOllamaベースのLLM実験環境をGitHubで公開

3つのポイント

  1. 何が起きたか

    AI Security Labが実験環境を説明。PythonがOllamaのAPIを直接呼びLLMを実行、コードはGitHubのkondonator/ai-security-playgroundにある。

  2. なぜ重要か

    同じプロンプトでもモデルやその他の条件によって異なる回答が得られるため、Labは各結果をテストした特定の条件下でのみ有効とみなす。

  3. 注目点

    この環境は参照用であり、Labは実験実行にWeb UIを使うことは将来の可能性と注記。次の記事では実際にPrompt Injectionを引き起こして挙動を観察する。

誰に効くかPrompt InjectionテストなどLLMセキュリティ実験を再現したいセキュリティ研究者や開発者が、同じ公開コードと環境を検査して実行できるようになった。

わからないところ、AIに聞けます

質問と回答はこのページに公開されます。

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

このZenn記事はAI Security Labシリーズの一部である。前回の記事では、Labを始めた理由と、AIにどこまで仕事を任せられるかについて何を明らかにしたいのかを説明した。今回の記事は、今後の記事で共通して使う実験環境に焦点を当て、その説明を実際の実験結果から切り離している。実験結果は次回扱う。

LabはOllamaを使ってLLMをローカルで実行し、実験はOllama APIを直接呼び出すPythonプログラムで実行する。コードはexperimentsディレクトリ以下で実験番号ごとに管理され、一式はGitHubリポジトリkondonator/ai-security-playgroundで公開されている。これは条件をできるだけ揃えて実験を再現可能かつ比較可能にするためである。

Labは、結果がモデルを含む多くの条件に依存するため、あるモデルでの知見がすべてのLLMに自動的に当てはまるわけではなく、同じモデルでも異なる条件下では同じ結果にならない可能性があると強調する。そのためLabは結果を絶対的な性質ではなく特定の条件に結びついた観察として扱い、複数モデルを使って順位付けしているわけではない。次の記事は環境構築から実際の実験へ移り、Prompt Injectionから始まる予定である。その実演がLabの環境を超えて一般化するかは、使うモデルと条件次第である可能性が高く、Labの姿勢は読者が今後の結果でそうした詳細に注目すべきことを示唆している。

よくある質問
この実験環境は誰が使えるのか?
Prompt InjectionテストなどLLMセキュリティ実験を再現したい研究者や開発者が、GitHubリポジトリの同じ公開コードを検査して実行できる。
実験ではどのLLMモデルを使うのか?
Labはgpt-oss:20bやgemma4:12bを含む複数のモデルを使い、同じ条件下で結果を比較する。
同じプロンプトは常に同じ結果を生むのか?
いいえ、Labはモデル、プロンプト、システムプロンプト、入力データ、会話履歴、推論設定、実行環境によって結果が異なり得るとしている。
LINEで送る

あなたの仕事に関係するAIニュースを、毎朝お届けします。

業界と使っているAIツールを選ぶと、仕事に関係するニュースが毎朝届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。

質問と回答はこのページに公開されます。

関連記事

次の記事へKaran Joshi、Museの内部ファイルを抽出