Нефільтрований ШІ: що це насправді означає

Оновлено:

TL;DR

Нефільтрований ШІ — це модель без шару модерації між вашим запитом і відповіддю, на відміну від систем, що імітують реакцію та відмовляються, пом’якшують або перефразовують ваше запитання. Це відрізняється від джейлбрейку (трюк проти фільтрованої моделі) та локальної моделі (потрібне ваше залізо). Хостований чат дає таку ж прямоту у вкладці браузера.

Якщо ви потрапили сюди після того, як звичайний чатбот відмовився відповідати на звичайне запитання, або вам цікаво, чи означають «нефільтрований ШІ» і «без цензури» одне й те саме, ця стаття роз’яснить обидва поняття. Ми розглянемо, що саме фільтрується, чим чат без фільтрів відрізняється від джейлбрейку чи локальної моделі, і чого навіть такий ШІ все одно не робитиме. Після прочитання ви чітко зрозумієте, що змінюється, коли знімають фільтр.

Фільтрований асистентПромпт для джейлбрейкуНефільтрований ШІ
Має шар модераціїТакТак, до патчуНі
Може відмовитися відповідатиЧастоІнодіРідко
Ламається після оновленнян/дТакНі
Порушує умови провайдеран/дТакНі
Запит прив’язаний до акаунтаТакТакНічого не прив’язано
Потрібне налаштування чи залізоНіНіНі, працює в браузері

Що насправді означає фільтрований ШІ

Нефільтрований ШІ — це модель без шару модерації чи відмови між вашим запитанням і відповіддю. Більшість звичайних чатботів працюють навпаки: система безпеки читає ваші слова, вирішує, чи виглядають вони ризиковано, і відмовляється, пом’якшує або тихо перефразовує те, що ви запитували, перш ніж ви побачите відповідь. Якщо прибрати цей шар, ви отримуєте фільтрований ШІ — та сама ідея, яку мають на увазі, кажучи «без цензури», просто інше слово для того ж самого. Цей матеріал розглядає загальну ідею; якщо вам потрібні саме фільтровані результати пошуку чи допомога з кодом, окремі гайди на цьому сайті детальніше розкривають тему фільтрованого пошуку та кодингу.

Де насправді живуть фільтри ШІ

Фільтр рідко є однією стіною, зазвичай це три шари, накладені один на одного. По-перше, вирівнювання під час навчання вчить саму модель відмовлятися від певних тем ще до того, як вона побачить ваш промпт. По-друге, прихований системний промпт — текст, який ви ніколи не бачите, — вставляється перед вашим повідомленням і вказує моделі, чого уникати та як формулювати відмову. По-третє, класифікатор виводу сканує готову відповідь і блокує або замінює її, якщо вона порушує правило, навіть якщо модель вже написала гарну відповідь. Будь-який із цих трьох шарів може перетворити звичайне запитання на відмову, і більшість сервісів запускають усі три одночасно, тому одне запитання можуть заблокувати двічі за різні причини.

Чому звичайні запитання отримують відмову

Кожен із наведених вище шарів працює за принципом пошуку шаблонів у ваших словах, а не розуміння вашого наміру, тому він сприймає ймовірний ризик так само, як і реальний. Студент-фармаколог, який запитує про взаємодію ліків, виглядає для системи так само, як хтось, хто шукає способи заподіяти шкоду. Дослідник кібербезпеки, який запитує, як працює експлойт, виглядає так само, як атакуючий. Саме тому звичайні запитання про медицину, право, безпеку, сексуальність, горе, дослідження залежностей чи художні твори з темними темами блокуються так само часто, як і справді небезпечні, бо фільтр не може розрізнити їх лише за формулюванням. Щоб дізнатися механізм цього явища, перегляньте окремий матеріал про те, чому ШІ відмовляється відповідати.

Нефільтрований ШІ проти промту для джейлбрейку

Джейлбрейк — це трюк із промптом, спрямований проти фільтрованої моделі: рольова рамка, підроблений системний повідомлення, ряд інструкцій, які мають «переконати» модель вийти з-під своїх правил. Він працює, доки провайдер не випустить патч (зазвичай протягом кількох днів), і його використання все одно порушує умови надання послуг провайдера, а ваше запитання фіксується під вашим акаунтом. Нефільтрований ШІ — це зовсім інший підхід: модель спочатку не мала шару відмови, тому нічого не потрібно «обходити», нічого не потрібно патчити і нічого не порушується. ШІ без фільтрів за дизайном поводиться послідовно, тоді як зламана модель може зламатися після найближчого оновлення.

Нефільтрований ШІ проти запуску локальної моделі

Запуск моделі з відкритими вагами на власному комп’ютері теж є фільтрованим у тому сенсі, що над нею немає чужого шару безпеки. Але ціна цього — зусилля: вам потрібне потужне залізо, ви повинні самі налаштувати та підтримувати програмне забезпечення, а модель, достатньо мала для локального запуску, зазвичай слабша за великі хостовані аналоги. Хостований чат без фільтрів дає вам таку ж прямоту, без шару відмови та переписування відповідей, без будь-яких налаштувань — у вкладці браузера, яку можна відкрити навіть із телефону. Вибір зводиться до того, чи хочете ви самі керувати інфраструктурою.

Чесні обмеження, які все ще діють

Нефільтрований не означає, що модель буде говорити все, щоб вам сподобалося. Вона не вигадуватиме факти лише тому, що ви хочете впевнену відповідь; пряма відповідь включає визнання того, що ніхто не знає певної інформації. У моделі є межа знань, тому вона не буде видавати себе за джерело, що підтверджує новини сьогоднішнього дня. Одна тверда лінія ніколи не змінюється незалежно від формулювання запиту: нічого сексуального з участю неповнолітніх, а також короткий список інших фіксованих обмежень, таких як інструкції щодо зброї масового ураження, тероризм та контент, що спрямований проти реальних людей із застосуванням насильства. Наприклад, notrack.ai публікує свої точні обмеження на сторінці /restrictions і описує себе як 99,9% без цензури, а не стверджує, що обмежень взагалі немає.

Чому приватність важливіша без фільтрів

Запитання, які люди ставлять фільтрованому ШІ, зазвичай є тими, які вони найменше хочуть бачити в історії свого акаунта: симптом хвороби, юридична проблема, запитання про власну сексуальність чи залежність когось із близьких. Видалення фільтра при збереженні логування вирішує лише половину проблеми. notrack.ai не вимагає створення акаунта, не прив’язує ваші запитання до особи, не запам’ятовує вас між сесіями і не використовує чати для навчання своїх моделей. Таке поєднання має значення тут більше, ніж у більшості програм, адже саме в чаті без фільтрів приватність і чесність мають приходити разом.

Як насправді користуватися ШІ без фільтрів

На практиці це простіше, ніж звучить концепція. Відкрийте чат і введіть своє запитання звичайними словами, так, як ви б запитали знайомого експерта, без необхідності обходити фільтр. Реєстрація не потрібна: notrack.ai працює безпосередньо в браузері, на комп’ютері або через додаток Android. Додайте документ, фото або PDF, якщо запитання вимагає контексту — результат аналізу, контракт, скріншот — і система прочитає файл як частину запитання. Вона відповідає будь-якою з 46 мов, якими ви пишете, тому немає потреби спочатку запитувати англійською.

Часто задавані питання

Що означає фільтрований ШІ?+

Нефільтрований ШІ — це модель без шару модерації чи відмови між вашим запитанням і відповіддю, на відміну від звичайних асистентів, що шукають шаблони у ваших словах і відмовляються, пом’якшують або перефразовують запитання. Модель просто відповідає на запитання, яке стоїть перед нею. Це та сама ідея, що й без цензурований ШІ, описана з точки зору того, що було прибрано, а не того, що моделі дозволено говорити.

Чи є фільтрований ШІ тим самим, що й без цензурований?+

Так. Нефільтрований ШІ та без цензурований ШІ описують одну й ту саму ідею: модель без шару модерації між вашим запитанням і відповіддю. «Нефільтрований» підкреслює те, що вилучено з конвеєра, «без цензури» — те, що моделі дозволено говорити. Люди шукають обидва терміни для одного й того ж результату, і вибір залежить лише від того, яке слово спало на думку першим.

Чи існує ШІ взагалі без фільтрів?+

Так, хоча ступінь різний. Деякі асистенти майже повністю знімають шар безпеки і залишають лише короткий опублікований список твердих обмежень, наприклад, контент із сексуалізацією неповнолітніх або інструкції щодо зброї масового ураження. Це відрізняється від зламаної звичайної моделі, яка все ще має фільтр під капотом; ви просто тимчасово обводите його, і вона знову може почати відмовлятися після наступного оновлення.

Яка різниця між фільтрованим ШІ та джейлбрейком?+

Джейлбрейк — це трюк із промптом, спрямований проти фільтрованої моделі; він ламається після патчу провайдера і все одно порушує умови надання послуг, а ваше запитання фіксується під вашим акаунтом. Нефільтрований ШІ не має шару відмови, якого можна «обійти» спочатку, тому немає нічого, що потрібно патчити, нічого, що порушувати, і відповідь не залежить від пошуку правильних слів.

Як знайти чат без фільтрів?+

Шукайте асистента, побудованого на власній незалежній моделі, а не версію з джейлбрейком звичайного продукту, оскільки джейлбрейк перестає працювати після будь-якого оновлення. notrack.ai — один із прикладів: без акаунта, без реєстрації та модель, створена для прямих відповідей, а не відмов. Перевірте опубліковану сторінку обмежень сервісу, перш ніж вважати його повністю необмеженим.

Чи є приватним чат без фільтрів?+

Не автоматично. Відсутність фільтрів нічого не говорить про те, що відбувається з вашими даними. Чат може бути без фільтрів, але все одно фіксувати кожне запитання в вашому акаунті. notrack.ai поєднує обидва аспекти: немає акаунта для створення, нічого не прив’язано до вашої особи, пам’яті про вас між сесіями немає, а чати не використовуються для навчання моделей.

Які чесні обмеження у фільтрованої моделі?+

Навіть фільтрована модель не вигадуватиме факти, щоб звучати впевнено, і має межу знань, тому не може підтверджувати новини останньої хвилини. Одна тверда лінія ніколи не змінюється: нічого сексуального з участю неповнолітніх, плюс короткий список інших фіксованих обмежень, що охоплюють зброю масового ураження та насильство проти реальних людей. «Нефільтрований» означає чесний і прямий, а не те, що обмежень взагалі немає.

Задайте будь-яке реальне запитання без фільтрів у приватному чаті без реєстрації.

Відкрити повний чат