フィルターなしAI:その実態とは

更新日:

TL;DR

フィルターなしAIとは、質問と回答の間に検閲や拒否の層がないモデルを指します。単に言葉のパターンマッチングで拒否するシステムとは異なります。 jailbreakはフィルター付きモデルに対するトリックであり、ローカルモデルは専用ハードウェアが必要です。ホストされたフィルターなしチャットは、ブラウザでその直接性を提供します。

メインストリームのチャットボットが普通の質問を拒否した後にここに来たのか、フィルターなしAIと検閲なしAIが同じ意味か疑問に思ったのか。ここでは両方を解説します。何がどこでフィルタリングされるか、フィルターなしチャットが jailbreakやローカルモデルとどう異なるか、そしてフィルターなしでも何ができないかをカバーします。フィルタリング層が取り除かれたときに何が変わるかが明確になります。

フィルター付きアシスタント jailbreakプロンプトフィルターなしAI
検閲層があるありあり(パッチまで)なし
質問を拒否できる頻繁たまにめったにない
ベンダーのパッチで壊れる該当なしありなし
利用規約違反該当なしありなし
質問がアカウントに紐づくありあり紐づくものなし
セットアップやハードウェアが必要なしなしなし、ブラウザで動作

フィルターなしAIの実際の意味

フィルターなしAIとは、質問と回答の間に検閲や拒否の層がないモデルです。ほとんどのメインストリームチャットボットは逆の方法で動作します:安全システムがあなたの言葉を読み、リスクがあるかどうかを判断し、返信を見る前に拒否、緩和、または静かに書き換えます。その層を取り除くとフィルターなしAIになり、これは検閲なしAIと同じ意味ですが、単に異なる表現です。この解説は一般的な概念をカバーしています。フィルターなし検索結果やフィルターなしコーディング支援が特定の目的の場合は、別ガイドで詳しく説明しています。

AIフィルターは実際にどこにあるか

フィルターは通常1つの壁ではなく、3つの層が積み重なったものです。まず、トレーニング時のアライメントにより、モデル自体がプロンプトを見る前に特定のトピックを拒否するよう学習します。次に、見えないシステムプロンプトがメッセージの前に挿入され、何を避け、どのように拒否するかを指示します。最後に、出力分類器が完成した返信をスキャンし、ルールに引っかかった場合はブロックまたは置換します。これら3つのいずれかが普通の質問を拒否に変える可能性があり、多くのサービスはこれらを同時に実行するため、1つの質問が異なる理由で2回ブロックされることがあります。

普通の質問が拒否される理由

上記の各層は意図を理解するのではなく言葉のパターンマッチングで動作するため、妥当なリスクを実際のリスクと同じように扱います。薬理学の学生が薬物相互作用を尋ねるのも、危害を求める人も同じように見えます。セキュリティ研究者がエクスプロイトの仕組みを尋ねるのも、攻撃者と見なされます。これが、医療、法律、セキュリティ、性、悲しみ、中毒研究、ダークテーマのフィクションに関する普通の質問が、実際に危険なものと同じ頻度でブロックされる理由です。このパターンの仕組みについては、AIが回答を拒否する理由に関する別の解説を参照してください。

フィルターなしAIと jailbreakプロンプトの違い

jailbreakは、フィルター付きモデルに対するプロンプトリックです:ロールプレイの枠組み、偽システムメッセージ、モデル自身のルールを説得するための指示の文字列です。ベンダーがパッチを当てるまで機能し、通常数日で無効化されます。使用すると依然としてそのプロバイダーの利用規約に違反し、質問はアカウントに記録されます。フィルターなしAIは全く異なるアプローチです:モデルには最初にトリックを仕掛けるべき拒否層がないため、パッチも違反もありません。フィルターなしのAIは設計上一貫した動作をし、 jailbreakされたモデルは1回のアップデートで壊れる可能性があります。

フィルターなしAIとローカルモデルの実行の違い

自分のコンピュータでオープンウェイトモデルを実行することも、他の人の安全層が上に乗っていないという意味でフィルターなしです。ただし、その代償は努力です:高性能なハードウェアが必要で、ソフトウェアのセットアップと維持を自分で行い、ローカルで実行できるモデルは通常、大規模なホストされたモデルよりも弱いです。ホストされたフィルターなしチャットは、セットアップなしでブラウザタブからスマホでも開ける同じ直接性を提供します。選択のほとんどは、インフラストラクチャを自分で管理したいかどうかにかかっています。

依然として適用される正直な限界

フィルターなしでも、モデルがあなたを喜ばせるために何でも言うわけではありません。自信のある答えが欲しいからといって事実をでっち上げることはなく、率直な答えには誰も知らないことを認めることも含まれます。知識の截止点があるため、今日のニュースを検証したふりはしません。リクエストの表現方法に関係なく、動かない硬い線が1つあります:未成年者に関する性的コンテンツ、および大量死兵器、テロリズム、実在の人物を対象とした暴力を含む他の限られた固定された限界です。 notrack.aiは、制限がないと主張するのではなく、99.9%検閲なしであると自己説明し、正確な制限を /restrictions で公開しています。

フィルターなしにおいてプライバシーがより重要な理由

人がフィルターなしAIに持ち込む質問は、通常、アカウント履歴に残ってほしくないものです:医療症状、法的問題、自身の性や他人の中毒に関する質問。ログ記録を残したままフィルターを取り除くだけでは問題の半分しか解決しません。 notrack.aiはアカウントを必要とせず、質問を身元と紐付けず、セッション間で記憶せず、チャットをモデルのトレーニングに使用しません。この組み合わせは、他のソフトウェアよりもここで重要になります。フィルターなしチャットはまさにプライバシーと正直さが共に届く場所だからです。

フィルターなしAIを実際に使う方法

実際には、概念ほど複雑ではありません。チャットを開き、フィルターを気にせず、知識豊富な友人に尋ねるように普通の言葉で質問を入力します。サインアップ不要: notrack.aiはデスクトップまたはAndroidアプリを通じてブラウザで直接動作します。質問にファイルが必要な場合は、ドキュメント、写真、PDFを添付してください。ラボ結果、契約書、スクリーンショットを読み取り、質問の一部として処理します。46の言語のいずれで書いたかと同じ言語で返信するため、英語で尋ねる必要はありません。

よくある質問

フィルターなしAIとは何ですか?+

フィルターなしAIとは、質問と回答の間に検閲や拒否の層がないモデルを指します。言葉のパターンマッチングで拒否、緩和、または書き換えを行うメインストリームアシスタントとは異なります。モデルは単に目の前の質問に答えます。これは検閲なしAIと同じ概念で、モデルが何を言えるかではなく、何が取り除かれたかという観点から説明されています。

フィルターなしAIは検閲なしAIと同じですか?+

はい。フィルターなしAIと検閲なしAIは同じ概念を指します:質問と回答の間に検閲層がないモデルです。フィルターなしはパイプラインから取り除かれたものを強調し、検閲なしはモデルが何を言えるかを強調します。人は同じ結果のために両方の用語を検索し、選択は主にどちらの言葉が最初に浮かんだかにかかっています。

フィルターが全くないAIはありますか?+

はい、ただしその度合いは異なります。一部のアシスタントは安全層をほぼ完全に除去し、未成年者への性的コンテンツや大量死兵器の指示など、限られた硬い制限のリストのみを保持します。これは jailbreakされたメインストリームのモデルとは異なり、フィルターがまだ underneath にあります。一時的にトリックをかけているだけで、次のアップデート後に再び拒否する可能性があります。

フィルターなしAIと jailbreakの違いは何ですか?+

jailbreakはフィルター付きモデルに対するプロンプトリックです。ベンダーがパッチを当てると壊れ、質問はアカウントに記録されたまま利用規約に違反します。フィルターなしAIには最初にトリックを仕掛けるべき拒否層がないため、パッチも違反もありません。回答は適切な言葉を見つけることに依存しません。

フィルターなしのAIチャットはどうやって見つけますか?+

メインストリームの jailbreak版ではなく、独自の独立したモデルに基づいて構築されたアシスタントを探してください。 jailbreakはアップデート後に機能しなくなります。 notrack.aiはその例です:アカウント不要、サインアップ不要、そして拒否ではなく直接答えるように構築されたモデル。完全に制限されていないと仮定する前に、サービスの公開された制限ページを確認してください。

フィルターなしチャットはプライベートですか?+

自動的にではありません。フィルターを取り除くことはデータの処理について何も示しません。チャットはフィルターなしでも、すべての質問をアカウントにログ記録する可能性があります。 notrack.aiはこれらを組み合わせます:作成する必要のあるアカウントなし、身元と紐付くものなし、セッション間で記憶を保持しない、チャットはモデルのトレーニングに使用されない。

フィルターなしモデルの正直な限界は何ですか?+

フィルターなしモデルでも、自信を持って聞こせるために事実をでっち上げることはなく、知識の截止点があるため、速報を検証できません。動かない硬い線が1つあります:未成年者に関する性的コンテンツ、および大量死兵器や実在の人物への暴力など、他の限られた固定された制限のリスト。フィルターなしとは正直で直接的であることであり、制限が全くないという意味ではありません。

サインアップ不要のプライベートチャットで、フィルターなしのままどんな本質的な質問でもしてください。

フルチャットを開く