NeMo Guardrails
NVIDIAが作っている超強力なツール!プログラミングっぽくルールを書けるので、自由度がすごいです。
「不適切な回答」を防ぐ確率!ガードレールを入れるだけでこんなに変わるなんて驚きです。
基本的なツールの導入にかかる時間。意外とすぐに始められるんだな、って思いました!
オープンソースツールの利用料金。初心者の私には、無料で始められるのが一番嬉しいポイントです。
世の中にはたくさんのAI保護ツールがあって、最初はどれを選べばいいかパニックになりました!「NeMo Guardrails」や「Llama Guard」など、名前だけ聞いてもさっぱりですよね。でも、調べていくうちに、自分の目的に合わせて選ぶのが一番だと気づきました。
例えば、会話の流れをしっかりコントロールしたいならNeMo、単純に「悪い言葉」をフィルタリングしたいならLlama系が良さそうです。「あれもこれも」と欲張らずに、まずは一つ試してみることが大切なんだって学びました!
NVIDIAが作っている超強力なツール!プログラミングっぽくルールを書けるので、自由度がすごいです。
Meta(旧Facebook)のモデル。安全かどうかを判定する専用のAIみたいな感じで、導入がシンプル!
出力の形式をきれいに整えてくれるツール。エラーを防ぐのにめちゃくちゃ役立ちます!
まずはライブラリをインストール!コマンド一つで入るから、ここは意外と簡単でした。
「config.yml」という設定ファイルを作ります。ここに「この話題はダメ!」というルールを書きます。
プロンプトと連携させて、テスト実行!ちゃんとブロックされた時は、思わず「おぉー!」って声が出ました。
Fig. 1: ガードレールがAIモデルの周りを囲んで、悪い入力(プロンプトインジェクションなど)を弾き返しているイメージです。こうやって視覚化すると、何を守っているのか分かりやすいですよね!