Чому ШІ іноді вигадує

Чому ШІ іноді вигадує [Відео та вікторина]

Коротка відповідь: Штучний інтелект іноді вигадує речі, бо передбачає правдоподібні наступні слова, а не перевірені факти – вільне володіння мовою не є доказом. Коли тема нішева, має високі ставки або вимагає точних імен і цифр, прогалини заповнюються впевненими припущеннями, якщо ви не обґрунтуєте відповідь і не перевірите вибірково вагомі твердження.

Статті, які вам, можливо, буде цікаво прочитати після цієї:

🔗 Перестаньте ставитися до ШІ як до Google.
Дізнайтеся, чому кращі результати ШІ потребують іншого підходу.

🔗 Ваша перша належна підказка зі штучним інтелектом.
Створіть чітку та ефективну підказку, використовуючи просту структуру.

🔗 4 складові чудової підказки зі штучним інтелектом.
Відкрийте для себе чотири важливі елементи, які покращують якість підказок зі штучним інтелектом.

🔗 Що ж таке ШІ?
Зрозумійте штучний інтелект простими, практичними та повсякденними термінами.

Ключові висновки:

Незнання передбачення: Ставтеся до вільної прози як доповнення шаблону, а не як до свідчення під присягою.

Пастка впевненості: напористий тон – це стиль; точність потребує окремої перевірки поза чатом.

Підроблена упаковка: Перш ніж довіряти акуратним спискам літератури, самостійно пошукайте назви джерел та цитати.

Обґрунтуйте відповідь: вставте примітки до джерел та забороніть вигадані URL-адреси, дослідження чи статистику.

Аудит людиною: Спочатку вибірково перевіряйте найризикованіші заяви, особливо щодо охорони здоров'я, права чи фінансів.

Чому штучний інтелект іноді вигадує інфографіку

Передбачення — це не те саме, що знання

Ось простіша версія: більшість моделей чату — це машини зі шаблонами. Ви ставите запитання. Вони генерують відповідь, яка відповідає формі гарної відповіді. Ця форма включає факти, тон, структуру — весь костюм. Іноді костюм огортає справжні знання. Іноді він огортає впевнену здогадку, яка заповнила прогалину.

Гадаю, вільна метафора допоможе, тоді я трохи повернуся назад. Уявіть собі джазового піаніста, який чув мільйон пісень. Попросіть його зіграти «ту саму про синю валізу», і він може вигадати чудову мелодію, якої ніколи не існувало, — бо прохання звучало так, як мало б звучати. ​​Зачекайте — це перебільшує артистизм. Це більше схоже на автозаповнення на стероїдах. Модель завершує правдоподібний абзац, а не відкриває картотеку з написом «Правда».

Тож, коли люди запитують , чому ШІ іноді вигадує, коротка відповідь така: прогалини заповнюються тим, що звучить статистично правильно. Відсутність цитати призводить до того, що модель вигадує щось, що виглядає академічно. Не впевнена в цифрі, вона пропонує акуратну цифру. Без другого імені людини вона вигадує те, що відповідає епосі та культурі. Спочатку трохи дивно. Як тільки ви побачите закономірність, вже не так. 

  • Метою покоління є вільний текст, а не перевірена істина.
  • Порожні прогалини в знаннях все ще заповнюються словами.
  • Ймовірність «звучить правильно» може перевершити «є правильним» у рейтингу моделі.

Впевненість проти точності – незручна різниця

Люди підстраховані, коли не впевнені. Ми кажемо «я думаю», «можливо», «мені потрібно перевірити». Моделі також можуть підстрахуватися — якщо ви їх про це попросите — але вихідні дані за замовчуванням часто читаються як впевнений брифінг. Цей полірування є особливістю навчання корисності, а не сигналом того, що кожне твердження було обґрунтованим.

Впевненість і точність – це різні показники. Один може бути на високому рівні, а інший – майже на нулі. Ви також відчували це з людьми: колега, який з повною впевненістю пояснює неправильний процес. Штучний інтелект може виконувати той самий танець, тільки швидше та з кращим форматуванням.

Практичний висновок: ставтеся до наполегливого формулювання як до стилю, а не до доказів. Якщо відповідь не містить джерел, які ви можете перевірити, не визнає невизначеності та містить купу конкретних імен чи цифр – зменште темп. Конкретність без обґрунтування – це класичний знак. 

  • Напористий тон ≠ перевірений контент.
  • Попросіть модель навмисно позначити невизначеність.
  • Віддайте перевагу фразі «ось у чому я не впевнений», а не фальшивому герметичному брифу.

Вигадані цитати та деталі, які виглядають реальними

Це щипає, бо виглядає так професійно. Фальшиві назви статей. Фальшиві назви журналів. Фальшиві URL-адреси, які майже клікабельні. Фальшиві цитати, що приписуються відомим людям. Форматування часто ідеальне – курсив, заповнювачі у формі року навмисно уникаються, імена, що звучать як автори, – і це пакування обманює скімерів.

Це відбувається з прозорої причини. Форма цитування є поширеною в навчальному тексті. Коли ви запитуєте «джерела», модель може видати форму наукової роботи, не витягуючи реального запису. Це як попросити когось намалювати чек по пам’яті. Ви отримаєте щось, що виглядає як чек. Магазину, можливо, ніколи не існувало.

Якось я спостерігав, як у чернетці вигадували дослідження про продуктивність віддаленої роботи з бездоганно виглядаючим списком авторів. Воно виглядало як рецензоване. Але нічого собі. У цьому й полягає небезпека: ваш мозок розслабляється, коли упаковка виглядає дорогою. Не розслабляйтеся. 

  • Вимагайте назви, які ви можете знайти самостійно, а потім серйозно їх шукайте.
  • З підозрою ставтеся до акуратних пакетів «цитування плюс атрибуція», про які ви ніколи не просили.
  • Якщо «джерело» не вдається швидко знайти, вважайте твердження необґрунтованим.

Коли ризик винаходу найвищий

Не кожна балачка однаково небезпечна. Вірш про каву може вільно вигадувати метафори – ось у чому суть. Доза ліків, юридичний дедлайн, цінова політика конкурента чи історичне твердження про опубліковану статтю живуть на іншій планеті.

Ризик зростає, коли тема нішева, актуальна або дуже специфічна. Він також зростає, коли ви наполягаєте на точних цифрах, назвах документів, внутрішній роботі приватних компаній або «переліку десяти рецензованих досліджень». Чим точніше запит, тим більша спокуса для моделі заповнити прогалини правдоподібним висловом.

Довгі вражаючі відповіді можуть бути ризикованішими, ніж короткі обережні. Довжина виглядає як зусилля. Зусилля схожі на турботу. Турбота схожа на правду. Цей зміїний ланцюг вражень – це те, як погані факти прослизають у слайд-колоди. 

  • Високий ризик: здоров'я, право, фінанси, дотримання вимог, безпека, імена людей, точна статистика.
  • Середній ризик: процеси нішевої галузі, налаштування інструментів, списки «найкращих практик».
  • Менший ризик: мозковий штурм, складання плану, переписування власного чернетки, редагування тону.

Надійні та ненадійні результати - швидке порівняння

Стіл перевершує іншу підбадьорливу розмову. Включно з незначними дивацтвами, бо звичайні розмови химерні.

Сигнал Як це виглядає Як перевірити Швидке виправлення
Обґрунтована відповідь Збігається з документами, які у вас вже є; визнає прогалини; цитує назви, які можна перевірити Порівняйте з вашими вихідними файлами або відомим посиланням Попросіть його цитувати лише вставлений текст
Впевнено неправильна відповідь Плавна проза; конкретні імена/цифри; жодних перешкод Спочатку перевірте одне вагоме твердження "Позначте кожне твердження як перевірене / невпевнене / невідоме"
Сфабриковане цитування Гарний список літератури; назви, які «мають» існувати Шукайте точну назву; знайдіть справжню сторінку автора Заборонити вигадані джерела; вимагати "сказати, якщо не знаєте"
Заповнювач візерунка Загальні найкращі практики, які можуть підійти будь-якій компанії Запитайте себе: «Що зміниться для моїх обмежень?» Вставте свої конкретні обмеження; вимагайте індивідуальних редагувань
Переповнений список Рівно десять предметів, коли ти просив десять — усі акуратно розкладені Оскарження пунктів 3 та 7 для доказів Дозвольте менше товарів; надавайте перевагу якості, а не кількості

Тримайте цю ментальну картку під рукою. Ви почнете помічати тремтячі результати так само, як помічаєте трохи дивну посмішку на фотографії — щось поставлено.

Як розпізнати вигадані відповіді, не впадаючи в параною

Вам не потрібно перевіряти кожен прикметник. Вам потрібна дешева звичка перевірки тверджень, які мають значення. Вибірково перевіряйте найгострішу грань: число, назву, політику, цитату. Якщо ця грань не спрацює, решта відповіді підлягає випробувальному терміну.

Ще один ознака: внутрішня суперечність. Модель каже, що інструмент «завжди» виконує X, а потім описує виняток так, ніби він стандартний. Або ж винаходить функцію, а потім пояснює, як її вимкнути — як мрія, яка постійно винаходить двері. Задавайте подальші питання, які тикають у слабкі місця. Вигадані світи мають тенденцію хитатися під тиском.

Також зверніть увагу на «занадто ідеальне» оформлення. Кожен абзац однаково відшліфований. Кожна рекомендація однаково впевнена. Справжній досвід зазвичай має текстуру – застереження, компроміси, «це залежить від обставин». Пласка досконалість заслуговує на додаткову увагу. 

  • Спочатку перевірте найризикованіше твердження, а не все есе.
  • Запитайте «у чому ви найменше впевнені?» і подивіться, чи зісковзне маска.
  • Перевіряйте імена, посади та номери поза чатом.
  • Надавайте перевагу відповідям, пов'язаним з вставленим вами текстом, а не очевидним фактам.

Звички, що спонукають до швидкого розвитку, зменшують винахідливість

Ви не можете позбутися галюцинацій за допомогою чарівного речення — вибачте — але ви можете зменшити радіус вибуху. Гарні підказки обмежують гру. Погані підказки запрошують до імпровізації.

Спробуйте такі звички. Вони звучать сухо. Вони працюють частіше, ніж хитрі підказки.

  • Обсяг знань: «Використовуйте лише ті нотатки, які я вставляю. Якщо чогось бракує, скажіть, що ви не знаєте».
  • Заборонити фальшиві джерела: «Не вигадуйте цитати, посилання чи URL-адреси».
  • Примусове позначення невизначеності: «Позначити кожен пункт тегом: відомо / передбачено / припущення».
  • Запитайте альтернативи: «Наведіть два варіанти та поясніть, чому кожен з них може бути неправильним».
  • Запит на отримання дозволу на сумніви: «Перелічіть зроблені вами припущення».
  • Надавайте перевагу структурі над атмосферою: таблиці, контрольні списки та колонки тверджень/доказів.

Дивно, але якщо сказати моделі, що можна сказати «Я не знаю», це зменшує соціальний тиск на впевненість у виконанні. Моделі відображають завдання. Якщо завдання винагороджує повноту будь-якою ціною, ви отримуєте вигадку з форматуванням. Якщо завдання винагороджує чітке обговорення прогалин, ви отримуєте менше блискучої брехні. 

І так, подальші повідомлення мають значення. Перші відповіді – це чернетки. «Це посилання виглядає фальшивим – видаліть усе, що не можете перевірити» – це цілком нормальне друге повідомлення. Ставтеся до чату як до редагування, а не як до торговельного автомата, який винен вам правду з першої ж монети.

Заземлення, подальші дії та життя в умовах невизначеності

Заземлення означає прив’язку відповіді до чогось поза межами імпровізації моделі: вашого вставленого документа з політикою, вашої електронної таблиці, нотаток до зустрічі, відомої публічної сторінки, яку ви самі перевірите. Коли відповідь має залишатися всередині цього паркану, у винахідливості менше простору для розвитку.

Подальші дії – це друга перешкода. «Звідки взялося це число?» «Яка частина є висновком?» «Перепишіть без будь-яких іменованих досліджень». Кожне питання – це невеликий аудит. Гадаю, це дорослий спосіб використовувати ці інструменти – не поклоніння, не паніка, просто аудит.

Невизначеність — це не помилка у вашому робочому процесі. Це погода. Інколи модель чудово підсумовує ваш власний текст. Інколи вона вигадує підкомітет, який ніколи не збирався. Ваше завдання — вирішити, які результати потребують додаткового захисту. 

  • Вставте вихідний матеріал, коли важлива точність.
  • Запитуйте теги достовірності на рівні заяв.
  • Тримайте людину в курсі важливих рішень.
  • Збережіть «творчу свободу» для творчих завдань, а не для дотримання вимог.

Що робити, коли у вас галюцинація посеред сонливості

Не заходьте по спіралі. Не відмовляйтеся від інструменту назавжди, ніби він особисто вас зрадив — хоча бажання може бути гострим. Виправте тему та продовжуйте.

Простий цикл відновлення:

  • Скажіть: «Це джерело виглядає вигаданим. Видаліть непідтверджені твердження».
  • Переприв’язати: вставити справжній документ, цитату або дані.
  • Перебудуйте вузько: попросіть виправлений розділ, а не зовсім нове есе про порожню поліровку.
  • Перевірте ще раз гострі краї: назви, номери, кроки процесу.
  • Визначте рівень довіри: партнер для мозкового штурму проти помічника з написання чернетки проти «не для цієї теми».

Вловлювання однієї галюцинації може покращити решту розмови, якщо ви посилите обмеження. Модель не «відчуває провини», але ваші чіткіші інструкції змінюють те, для чого вона оптимізується. Ви керуєте. Керуйте наполегливіше, коли проявляється винахідливість. 

Повсякденні сценарії, де це непомітно має значення

Робочі електронні листи: вигаданий «стандартний галузевий графік» може встановити очікування, яких ви не зможете досягти. Школа та навчання: фальшиве пояснення може засісти у вашій голові, перш ніж ви помітите. Чернетки служби підтримки клієнтів: вигадане правило повернення коштів стає обіцянкою. Креативне письмо: вигадуйте – ось вам і майданчик.

Наскрізна лінія — це наслідок. Якщо неправильні слова коштують грошей, довіри, оцінок чи безпеки, перевірка не є необов'язковою рутиною. Якщо неправильні слова коштують лише знизування плечима, розслабтеся. Співвідношення обережності до наслідків — це тут доросла навичка, більше, ніж просто запам'ятовування слова «галюцинація»

Також: команди повинні нормалізувати «Я перевірив це твердження» так само, як вони нормалізують «перевірку орфографії пройдено». Інакше один відшліфований абзац за одну ніч перетворюється на племінне знання. Фу.

Ключові висновки

Отже, питання «Чому ШІ іноді вигадує» зводиться до наступного: ці системи передбачають правдоподібну мову, заповнюють прогалини за допомогою зіставлення зі зразками та часто звучать впевнено, роблячи це. Таке поєднання створює впевнені неправильні відповіді, вигадані цитати та акуратні деталі, яких ніколи не було.

Вам не потрібно боятися цього інструменту. Вам потрібні звички. Вибірково перевіряйте вагомі твердження. Забороняйте вигадані джерела. Вставляйте конкретний контекст. Запитуйте про невизначеність. Використовуйте подальші дії як аудити. Залиште вільне генерування для творчої роботи з низькими ставками.

Вільне володіння мовою — це не характеристика характеру. Ставтеся до цього як до талановитого стажера, який друкує неймовірно швидко, іноді вигадує зустріч, якої ніколи не було, і все одно може досягти успіху під наглядом. Зберігайте нагляд. Зберігайте дотепність. Зберігайте скептицизм легким, але обґрунтованим. Ось як ви отримаєте перевагу, не видаючи вигадку за факт.

Практичний приклад: Виявлення вигаданих цитат у дослідницькому брифі конкурента

Галюцинації здаються абстрактними, доки відшліфований абзац мало не не потрапляє в клієнтську колоду. Ось як британський маркетинговий аналітик використав звички з цього посібника, щоб перестати поширювати художню літературу, замаскувану як дослідження, — не відмовляючись від чат-бота.

Сценарій

У Сема є дві години, щоб скласти односторінковий бриф для конкурента для початку продажів. Запитання знайоме: сильні сторони, цінові сигнали та «кілька достовірних джерел». За старою звичкою Сем набрав «підсумувати конкурента X з джерелами» та отримав акуратний бриф з трьома цитатами, що виглядали академічно, та точним відсотком частки ринку. Він звучав коротко. Здебільшого він був вигаданим. Одну назву знайти не вдалося. Показник частки ніде не з'являвся на сайті конкурента.

Сему не потрібна краща модель. Сему потрібен обґрунтований робочий процес: вставка нотаток до джерел, заборона фальшивих джерел, примусове встановлення міток невизначеності, вибіркова перевірка спочатку найчіткіших тверджень, а потім перебудова лише пошкодженої частини.

Мета — це короткий опис, якому команда може довіряти для обговорення, а не квитанція, складена по пам'яті, яка лише виглядає як квитанція.

Що потрібно помічнику

  • Вихідні матеріали, які вже є у Сема: текст головної сторінки, текст сторінки з цінами, два нещодавні запити в службу підтримки, нотатки про програну угоду
  • Суворе правило: використовуйте вставлений текст лише для фактичних тверджень; кажіть «Я не знаю», коли нотатки мовчать
  • Заборона на вигадані цитати, посилання та статистику
  • Вихідна форма, яка розділяє відомі / здогадки / припущення
  • Час для однієї вибіркової перевірки імен, номерів та будь-яких «вихідних» назв людиною, перш ніж колода буде передана на розгляд
  • Дозвіл поставити до трьох уточнюючих запитань замість заповнення пропусків

Приклад інструкції

Повідомлення 1 – обґрунтований бриф: Використовуючи лише нотатки, які я вставляю нижче, складіть односторінковий бриф конкурента для продажів. Розділи: Що вони стверджують / На що скаржаться клієнти / Ціноутворювальні сигнали / Відкриті питання. Не вигадуйте цитати, посилання чи статистику. Якщо факту немає в нотатках, напишіть «невідомо» та вкажіть його у розділі Відкриті питання. Позначте кожен пункт тегами: відомий / здогадується / здогадка. Британська англійська. Без преамбули.

Повідомлення 2 – сумнів пройшов: Перелічіть усі ваші припущення. Видаліть усе, що позначено тегом «здогадка», якщо ви не можете вказати на вставлене речення, яке це підтверджує. Якщо ви раніше вигадали джерело, видаліть його та повідомте про це.

Повідомлення 3 – вузька перебудова: Ця лінія частки ринку не підтримується. Перепишіть лише розділ «Ціноутворювальні сигнали» без цифр, якщо вони не вказані в моїх нотатках. Збережіть інші розділи.

Як це перевірити

  • Сформулюйте вільне запитання («підсумуйте конкурента X за допомогою трьох рецензованих джерел») та обґрунтоване завдання вище. Порівняйте вигадані назви та фальшиву статистику.
  • Спочатку перевірте найризикованіше твердження (цифру або назване дослідження), а не всю сторінку.
  • Запитайте: «У чому ви найменше впевнені?» Сильна відповідь називає прогалини; невпевнена подвоює впевненість.
  • Граничний випадок: видаліть ціни зі вставлених нотаток і підтвердьте, що в чернетці вказано «невідомо», замість того, щоб вигадувати ціну плану.
  • Перевірки прийняття перед публікацією: (1) кожен «відомий» маркований список відповідає вставленому рядку, (2) жодного вигаданого посилання, (3) відкриті питання містять справжні прогалини, (4) ви самостійно шукали будь-яку решту назви, (5) немає точної статистики без примітки під нею.

Результат

Ілюстративний результат (приклад оцінки для робочого процесу конкурентного брифу одного аналітика, а не опублікованого дослідження): У 8 завданнях брифінгу час настінного годинника від «відкриття нотаток» до «чернетки, готової до перевірки фактів людиною» дещо зріс із медіани приблизно 12 хвилин (одноразова відшліфована вигадка) до приблизно 15 хвилин з обґрунтованою підказкою, але ризик очищення та збентеження знизився. Перевірка людиною достовірних тверджень скоротилася з медіани приблизно 18 хвилин (пошук фальшивих назв та переписування) до приблизно 6 хвилин, коли твердження були попередньо позначені тегами, а вигадані джерела заборонені, тому чистий час скоротився приблизно на 9 хвилин на бриф, або приблизно на 72 хвилини по всьому набору. У контрольному списку прийняття (без вигаданих цитат, без непідтвердженої статистики, наявність відомих/вигаданих/здогадок, відкриті питання, що називають прогалини), 7 з 8 обґрунтованих чернеток були прийняті після першого перегляду порівняно з 2 з 8 одноразових чернеток. Обмеження: невелика вибірка, один аналітик, один тип брифу; легкі конкуренти з чітким публічним ціноутворенням зменшують розрив; «Час перевірки» включав пошук в Інтернеті підозрілих назв.

Щоб виміряти власну версію: виконайте 5 брифів з вашою поточною звичкою та 5 зі вставленими джерелами + забороненими вигаданими цитатами + тегами заяв; запишіть середній час написання чернетки, середній час перевірки та рівень успішного складання контрольного списку з вказаним знаменником.

Що може піти не так

  • Упередженість у вільному мовленні: ідеальна граматика та акуратні марковані списки змушують вас пропускати вибіркову перевірку.
  • Косплей цитування: запит на «джерела» без вставленого матеріалу запрошує до форми наукової роботи без відповідного запису.
  • Надмірно повні списки: «Дайте мені десять досліджень» – це винагорода за заповнення, коли у ваших нотатках є лише три.
  • Перебудова всього есе: Після одного фальшивого рядка попросіть коротко переписати цей розділ, а не оновити його.
  • Важливі теми: охорона здоров'я, право, фінанси та дотримання вимог потребують надійніших людських ресурсів, ніж просто короткий опис теми для обговорення з клієнтами.
  • Без людського циклу: чернетка з тегами все ще може неправильно прочитати вставлене речення. Сем все ще володіє кнопкою «поділитися».

Практичний висновок

Штучний інтелект вигадує речі, бо передбачає правдоподібну мову, яка вставляється у прогалини, а не тому, що хоче вас обдурити. Ставтеся до плавності мови як до стилю, а не до доказів. Приклейте перешкоди, забороняйте фальшиві джерела, позначайте невизначеність, перевіряйте найгостріші твердження та виправляйте тему, коли щось хитається. Саме так ви зберігаєте перевагу швидкого партнера по написанню текстів, не надсилаючи впевнену історію, якої ніколи не було.

Найчастіші запитання

Чому ШІ іноді вигадує?

Більшість моделей чату є шаблонними машинами: вони генерують відповідь, яка відповідає формі гарної відповіді, а не перевіреної картотеки з написом «Правда». Прогалини заповнюються тим, що звучить статистично правильно — цитатою, яка виглядає академічно, акуратним числом або деталлю, яка відповідає епосі. Вільний текст — це мета генерації, тому «звучить правильно» може перевершити «є правильним». Ось чому вигадані відповіді часто мають ідеальну граматику та акуратні марковані списки.

Чи впевненість у ШІ те саме, що й точність?

Ні. Впевненість і точність – це різні показники: один може бути високим, а інший – близьким до нуля. Вихідні дані за замовчуванням часто читаються як впевнений брифінг, оскільки навчання винагороджує корисне доопрацювання, а не тому, що кожне твердження було обґрунтованим. Ставтеся до наполегливого формулювання як до стилю, а не до доказів. Якщо відповідь не містить перевірених джерел, не має невизначеності та має багато конкретних імен чи цифр, уповільніть темп.

Чому чат-боти вигадують цитати та фальшиві джерела?

Форма цитування є поширеною в навчальних текстах, тому запит на «джерела» може створити форму наукового дослідження без отримання справжнього запису — як малювання підтвердження по пам’яті. Фальшиві назви статей, назви журналів, URL-адреси та цитати з посиланнями часто виглядають достатньо професійно, щоб обдурити користувачів, які переглядають текст. Вимагайте назви, які ви можете знайти самостійно; якщо джерело не можна швидко знайти, розглядайте твердження як непідтверджене.

Коли ризик винаходу штучного інтелекту найвищий?

Ризик зростає для нішевих, актуальних або дуже специфічних тем, а також коли ви наполягаєте на точних цифрах, названих документах, приватних внутрішніх даних або довгих списках рецензованих досліджень. До сфер високого ризику належать охорона здоров'я, право, фінанси, комплаєнс, безпека, імена людей та точна статистика. Мозковий штурм, складання планів, переписування власного чернетки та редагування тону зазвичай мають менший ризик. Довгі вражаючі відповіді також можуть здаватися безпечнішими, ніж вони є насправді.

Як я можу виявити вигадані відповіді ШІ, не перевіряючи кожне слово?

Спочатку перевірте найгостріший аспект – число, назву, політику чи цитату. Якщо це не спрацює, решту перевірте на випробувальному терміні. Звертайте увагу на внутрішні суперечності та «занадто ідеальну» упаковку без застережень чи компромісів. Запитайте, у чому модель найменше впевнена, перевірте імена та посади поза чатом і віддавайте перевагу відповідям, пов’язаним із текстом, який ви вставили поверх очевидних фактів.

Які звички швидкого реагування зменшують галюцинації, пов'язані зі штучним інтелектом?

Ви не можете позбутися галюцинацій одним чарівним реченням, але ви можете зменшити радіус вибуху. Обмежте знання вставленими нотатками та кажіть «Я не знаю», коли чогось бракує. Забороніть вигадані цитати, посилання та URL-адреси. Застосуйте теги типу «відомо» / «випливає» / «здогадка», запитуйте про припущення та надавайте перевагу структурі твердження/докази. Повідомлення моделі, що можна сказати «Я не знаю», зменшує тиск на демонстрацію хибної впевненості.

Що означає заземлення під час використання ШІ для фактичної роботи?

Обґрунтування пов'язує відповідь з чимось поза межами імпровізації моделі – вашим політичним документом, електронною таблицею, нотатками зустрічі або публічною сторінкою, яку ви перевірите самі. Коли відповіді мають залишатися всередині цього бар'єру, у винахідливості менше місця. Подальші дії діють як другий бар'єр: запитайте, звідки взялося число, яка частина є висновком, або перепишіть без іменованих досліджень. Тримайте людину в курсі важливих рішень.

Що робити, якщо під час розмови у мене виникли галюцинації?

Визначте це, переприв’яжіть до реального документа чи даних і відбудуйте лише пошкоджену частину, замість того, щоб запитувати зовсім нове відшліфоване есе. Перевірте ще раз чіткі межі – імена, цифри, кроки процесу – а потім вирішіть, чи є інструмент партнером для мозкового штурму, помічником у чернетці чи «не для цієї теми». Чіткіші обмеження змінюють те, для чого оптимізується модель; керуйте ретельніше, коли проявляється винахідливість.

Як мені припинити використання вигаданих цитат у дослідницькому брифі конкурента?

Вставте нотатки про джерела, які у вас вже є, забороніть фальшиві джерела та непідтверджену статистику, а також вимагайте теги відомі / висновок / припущення, а також список відкритих питань. Спочатку перевірте найризикованіші твердження, проведіть тест на сумніви, який видаляє припущення без підтвердження, та перепишіть лише пошкоджену частину, якщо число не підтверджується. Прийняття означає, що кожен «відомий» маркований список відповідає вставленому рядку, а будь-який заголовок, що залишився, шукається людиною.

Коли ще можна дозволити штучному інтелекту вільно винаходити?

Творче письмо та інші завдання з низькими ставками можуть вільно винаходити метафори – це і є майданчик для ігор. Співвідносьте обережність з наслідками: якщо неправильні слова коштують грошей, довіри, оцінок чи безпеки, перевірка не є необов'язковою. Якщо вони коштують лише знизування плечима, розслабтеся. Вільне володіння мовою – це не характеристика характеру; ставтеся до моделі як до швидкого стажера, якому все ще потрібен нагляд за фактичною роботою.

Посилання

  1. OpenAIopenai.com
  2. Антропнийanthropic.com
  3. NISTnist.gov
  4. IBM - ibm.com
  5. Штучний інтелект Googleai.google.dev
  6. Google CloudЗаземленняdocs.cloud.google.com
Вікторина
1. Згідно зі статтею, чому ШІ іноді вигадує?

2. Як слід ставитися до вільної прози, написаної штучним інтелектом?

3. Що таке «пастка впевненості», описана в посібнику?

4. Що слід зробити, перш ніж довіряти акуратним спискам посилань на штучний інтелект?

5. Яка звичка, згідно зі статтею, допомагає зменшити кількість вигаданих відповідей?


Повернутися до блогу