Кароткі адказ: штучны інтэлект часам выдумляе рэчы, таму што ён прадказвае праўдападобныя наступныя словы, а не правераныя факты — бегласць мовы не з'яўляецца доказам. Калі тэма вузкая, мае высокія стаўкі або патрабуе дакладных імёнаў і лічбаў, прабелы запаўняюцца ўпэўненымі здагадкамі, калі вы не абгрунтуеце адказ і не праверыце выбарачныя сцвярджэнні.
Артыкулы, якія вам могуць спадабацца пасля гэтага:
🔗 Перастаньце ставіцца да штучнага інтэлекту як да Google.
Даведайцеся, чаму лепшыя вынікі штучнага інтэлекту патрабуюць іншага падыходу.
🔗 Ваша першая правільная падказка са штучным інтэлектам.
Стварыце зразумелую і эфектыўную падказку, выкарыстоўваючы простую структуру.
🔗 4 складнікі выдатнай падказкі са штучным інтэлектам
Адкрыйце для сябе чатыры асноўныя элементы, якія паляпшаюць якасць падказак са штучным інтэлектам.
🔗 Што такое штучны інтэлект?
Зразумейце штучны інтэлект простымі, практычнымі і паўсядзённымі тэрмінамі.
Асноўныя высновы:
Прадказанне невядомае: разглядайце беглае маўленне як завяршэнне шаблону, а не як доказ пад прысягай.
Пастка ўпэўненасці: настойлівы тон — гэта стыль; дакладнасць патрабуе асобнай праверкі па-за чата.
Падробленая ўпакоўка: спачатку пашукайце назвы цытат і цытаты, а потым давярайце акуратным спісам літаратуры.
Абгрунтуйце адказ: устаўце заўвагі да крыніц і забараніце выдуманыя URL-адрасы, даследаванні або статыстыку.
Аўдыт чалавека: спачатку выбарачна правярайце найбольш рызыкоўныя заявы, асабліва ў галіне аховы здароўя, права або фінансаў.

Прадказанне — гэта не тое ж самае, што веданне
Вось простая версія: большасць мадэляў чата — гэта машыны шаблонаў. Вы задаеце пытанне. Яны генеруюць адказ, які адпавядае форме добрага адказу. Гэтая форма ўключае факты, тон, структуру — увесь касцюм. Часам касцюм ахінае рэальныя веды. Часам ён ахінае ўпэўненую здагадку, якая запоўніла прабел.
Думаю, тут дапаможа свабодная метафара, тады я крыху вярнуся. Уявіце сабе джазавага піяніста, які пачуў мільён песень. Папрасіце яго сыграць «ту самую пра сіні чамадан», і ён можа прыдумаць прыгожую мелодыю, якой ніколі не існавала — таму што просьба гучала так, як павінна была. Пачакайце — гэта перабольшвае мастацкасць. Гэта хутчэй як аўтазапаўненне на стэроідах. Мадэль завяршае праўдападобны абзац, а не адкрывае шафу з надпісам «Праўда».
Таму, калі людзі пытаюцца, чаму штучны інтэлект часам выдумляе рэчы, кароткі адказ такі: прабелы запаўняюцца тым, што гучыць статыстычна правільна. Адсутнасць цытаты прымушае мадэль выдумляць нешта, што выглядае акадэмічным. Не ведаючы лічбы, яна прапануе акуратную лічбу. Без імя па бацьку чалавека яна выдумляе тое, што адпавядае эпосе і культуры. Спачатку трохі дзіўна. Але калі вы ўбачыце заканамернасць, ужо не так.
- Мэта генерацыі — гэта беглы тэкст, а не правераная праўда.
- Пустыя прабелы ў ведах усё яшчэ запаўняюцца словамі.
- Верагоднасць «гучыць правільна» можа пераўзысці «ёсць правільна» ў рэйтынгу мадэлі.
Упэўненасць супраць дакладнасці - няёмкая прорва
Людзі падстрахоўваюцца, калі не ўпэўненыя. Мы кажам «Я думаю», «Магчыма», «Мне трэба праверыць». Мадэлі таксама могуць падстрахоўвацца — калі вы іх пра гэта папросіце, — але вывады па змаўчанні часта гучаць як упэўнены інструктаж. Гэтая адшліфоўка — асаблівасць навучання карыснасці, а не сігнал таго, што кожнае сцвярджэнне было абгрунтаваным.
Упэўненасць і дакладнасць — гэта розныя паказчыкі. Адзін можа быць на высокім узроўні, а другі — амаль на нулі. Вы таксама адчувалі гэта з людзьмі: калега, які з поўнай упэўненасцю тлумачыць няправільны працэс. Штучны інтэлект можа рабіць тое ж самае, толькі хутчэй і з больш прыемнай фарматоўкай.
Практычны вывад: ставіцеся да напорыстай фармулёўкі як да стылю, а не як да доказаў. Калі ў адказе няма крыніц, якія вы можаце праверыць, няма прызнання нявызначанасці і ёсць куча канкрэтных імёнаў або лічбаў — зменшце хуткасць. Канкрэтнасць без абгрунтавання — гэта класічны прыкмета.
- Настойлівы тон ≠ правераны кантэнт.
- Папрасіце мадэль наўмысна адзначыць нявызначанасць.
- Аддайце перавагу фразе «вось у чым я не ўпэўнены», а не фальшываму герметычнаму заключэнню.
Выдуманыя цытаты і дэталі, якія выглядаюць рэальнымі
Гэта дзівіць, бо выглядае вельмі прафесійна. Фальшывыя назвы артыкулаў. Фальшывыя назвы часопісаў. Фальшывыя URL-адрасы, якія амаль клікабельныя. Фальшывыя цытаты вядомых людзей. Фарматаванне часта ідэальнае — курсіў, запаўняльнікі ў форме года наўмысна пазбягаюцца, імёны гучаць як аўтары — і гэтая ўпакоўка падманвае скімераў.
Гэта адбываецца па зразумелай прычыне. Форма цытавання распаўсюджаная ў навучальным тэксце. Калі вы запытваеце «крыніцы», мадэль можа выдаць форму навуковай працы, не атрымліваючы рэальнага запісу. Гэта як папрасіць кагосьці намаляваць квітанцыю па памяці. Вы атрымліваеце нешта падобнае на квітанцыю. Крамы, магчыма, ніколі не існавала.
Аднойчы я назіраў, як у чарнавіку выдумлялі даследаванне пра прадукцыйнасць дыстанцыйнай працы з бездакорна выглядаючым спісам аўтараў. Здавалася, што яно рэцэнзавалася. Але нішто сабе. У гэтым і небяспека: ваш мозг расслабляецца, калі ўпакоўка выглядае дарагой. Не расслабляйцеся.
- Патрабуйце назвы, якія вы можаце знайсці самастойна, і пашукайце іх сур'ёзна.
- З падазрэннем ставіцеся да акуратных набораў цытат і атрыбуцыі, пра якія вы ніколі не прасілі.
- Калі «крыніцу» немагчыма хутка знайсці, лічыце сцвярджэнне беспадстаўным.
Калі рызыка вынаходніцтва найвышэйшая
Не кожная размова аднолькава небяспечная. Верш пра каву можа свабодна выдумляць метафары — у гэтым і сэнс. Доза лекаў, юрыдычны тэрмін, цэнавая палітыка канкурэнта або гістарычная прэтэнзія на апублікаваны артыкул жывуць на іншай планеце.
Рызыка ўзрастае, калі тэма нішавая, актуальная або вельмі спецыфічная. Яна таксама ўзрастае, калі вы настойваеце на дакладных лічбах, назвах дакументаў, унутраных дадзеных прыватных кампаній або «пералічыце дзесяць рэцэнзаваных даследаванняў». Чым больш дакладная просьба, тым большая спакуса ў мадэлі запоўніць прабелы праўдападобным напаўняльнікам.
Доўгія ўражлівыя адказы могуць быць больш рызыкоўнымі, чым кароткія асцярожныя. Даўжыня выглядае як намаганне. Намаганні выглядаюць як клопат. Клопат выглядае як праўда. Гэты змяіны ланцуг уражанняў — гэта тое, як дрэнныя факты праслізгваюць на слайдах.
- Высокая рызыка: здароўе, заканадаўства, фінансы, адпаведнасць патрабаванням, бяспека, імёны людзей, дакладная статыстыка.
- Сярэдняя рызыка: працэсы нішавых галін, налады інструментаў, спісы «лепшых практык».
- Меншая рызыка: мазгавы штурм, складанне планаў, перапісванне ўласнага чарнавіка, рэдагаванне тону.
Надзейныя і хісткія вынікі - кароткае параўнанне
Стол лепш за іншую падбадзёрлівую размову. У тым ліку невялікія дзівацтвы, бо звычайныя размовы — гэта нешта незвычайнае.
| Сігнал | Як гэта выглядае | Як праверыць | Хуткае выпраўленне |
|---|---|---|---|
| Абгрунтаваны адказ | Супадае з дакументамі, якія ў вас ужо ёсць; дапускае прабелы; цытуе назвы, якія можна праверыць | Параўнайце з вашымі зыходнымі файламі або вядомай спасылкай | Папрасіце яго цытаваць толькі ўстаўлены тэкст |
| Упэўнены няправільны адказ | Гладкая проза; канкрэтныя імёны/лічбы; ніякіх перашкод | Спачатку праверце адну сур'ёзную заяву | Пазначце кожнае сцвярджэнне як праверанае / няпэўнае / невядомае |
| Сфабрыкаваная цытата | Прыгожы спіс літаратуры; назвы, якія «павінны» існаваць | Шукайце дакладную назву; знайдзіце сапраўдную старонку аўтара | Забараніць выдуманыя крыніцы; патрабаваць «скажы, калі не ведаеш» |
| Запаўняльнік узору | Агульныя перадавыя практыкі, якія падыдуць любой кампаніі | Спытайце сябе: «Што зменіцца ў маіх абмежаваннях?» | Устаўце свае канкрэтныя абмежаванні; запатрабуйце індывідуальных змяненняў |
| Перапоўнены спіс | Роўна дзесяць прадметаў, калі ты прасіў дзесяць — усе акуратна складзеныя | Аспрэчванне пунктаў 3 і 7 для прадстаўлення доказаў | Дазвольце менш тавараў; аддавайце перавагу якасці, а не колькасці |
Трымайце пад рукой гэтую ментальную табліцу з паказчыкамі. Вы пачнеце заўважаць дрыготкія вынікі гэтак жа, як заўважаеце злёгку няўдалую ўсмешку на фота — нешта пазіруе.
Як знайсці выдуманыя адказы, не стаўшы параноікам
Вам не трэба правяраць кожны прыметнік. Вам патрэбна недарагая звычка праверкі важных сцвярджэнняў. Выбаркава правярайце самыя вострыя грані: лічбу, назву, палітыку, цытату. Калі гэтая грань не спрацуе, астатняя частка адказу — выпрабавальны тэрмін.
Яшчэ адзін сігнал: унутраная супярэчнасць. Мадэль сцвярджае, што інструмент «заўсёды» выконвае X, а потым апісвае выключэнне так, быццам яно стандартнае. Або яна вынаходзіць функцыю, а потым тлумачыць, як яе адключыць — як сон, які пастаянна вынаходзіць дзверы. Задавайце наступныя пытанні, якія тыкнуць у слабыя месцы. Выдуманыя светы маюць тэндэнцыю хістацца пад ціскам.
Таксама звярніце ўвагу на «занадта дасканалую» ўпакоўку. Кожны абзац аднолькава адшліфаваны. Кожная рэкамендацыя аднолькава ўпэўненая. Сапраўдная экспертнасць звычайна мае тэкстуру — агаворкі, кампрамісы, «гэта залежыць ад таго, што адбываецца». Плоская дасканаласць заслугоўвае дадатковай увагі.
- Спачатку праверце найбольш рызыкоўнае сцвярджэнне, а не ўсё эсэ.
- Спытайце: «У чым вы найменш упэўненыя?» і паглядзіце, ці слізгае маска.
- Правярайце імёны, тытулы і нумары па-за чата.
- Аддавайце перавагу адказам, звязаным з устаўленым вамі тэкстам, а не фактам, якія можна знайсці ў вольным доступе.
Звычкі, якія спрыяюць зніжэнню вынаходніцтва
Вы не можаце пазбавіцца ад галюцынацый магічным сказам — прабачце, — але вы можаце паменшыць радыус выбуху. Добрыя падказкі абмяжоўваюць гульню. Дрэнныя падказкі заахвочваюць да імправізацыі.
Паспрабуйце такія звычкі. Яны гучаць сумна. Яны працуюць часцей, чым хітрыя падказкі.
- Аб'ём ведаў: «Выкарыстоўвайце толькі тыя нататкі, якія я ўстаўляю. Калі чагосьці не хапае, скажыце, што вы не ведаеце».
- Забараніце фальшывыя крыніцы: «Не выдумляйце цытаты, спасылкі ці URL-адрасы».
- Прымусовае абазначэнне нявызначанасці: «Пазначыць кожны пункт: вядома / меркавана / здагадка».
- Папрасіце альтэрнатывы: «Назавіце два варыянты і растлумачце, чаму кожны з іх можа быць няправільным».
- Запытайце дазвол на сумнеў: «Пералічыце зробленыя вамі здагадкі».
- Аддавайце перавагу структуры перад атмасферай: табліцам, кантрольным спісам і слупкам сцвярджэнняў/доказаў.
Дзіўна, але калі сказаць мадэлі, што можна сказаць «Я не ведаю», гэта памяншае сацыяльны ціск на ўпэўненасць у выкананні. Мадэлі адлюстроўваюць заданне. Калі заданне ўзнагароджвае паўнату любой цаной, вы атрымліваеце выдумку з фарматаваннем. Калі заданне ўзнагароджвае выразнае абмеркаванне прабелаў, вы атрымліваеце менш бліскучай хлусні.
І так, наступныя паведамленні маюць значэнне. Першыя адказы — гэта чарнавікі. «Гэтая цытата выглядае фальшывай — выдаліце ўсё, што не можаце праверыць» — гэта цалкам нармальнае другое паведамленне. Стаўцеся да чата як да рэдагавання, а не як да аўтамата, які павінен вам сказаць праўду з першай манеты.
Зазямленне, наступныя дзеянні і жыццё ў нявызначанасці
Зазямленне азначае прывязку адказу да чагосьці па-за межамі імправізацыі мадэлі: вашага ўстаўленага дакумента палітыкі, вашай электроннай табліцы, нататак з сустрэчы, вядомай публічнай старонкі, якую вы самі праверыце. Калі адказ павінен заставацца ўнутры гэтай агароджы, у вынаходніцтва менш месца для разгону.
Далейшыя дзеянні — гэта другая перашкода. «Адкуль узялася гэтая лічба?» «Якая частка з'яўляецца высновай?» «Перапішыце без якіх-небудзь названых даследаванняў». Кожнае пытанне — гэта невялікая праверка. Думаю, гэта дарослы спосаб выкарыстання гэтых інструментаў — не пакланенне, не паніка, проста праверка.
Нявызначанасць — гэта не памылка ў вашым працоўным працэсе. Гэта надвор'е. Часам мадэль выдатна падсумоўвае ваш уласны тэкст. Часам яна стварае падкамітэт, які ніколі не збіраўся. Ваша задача — вырашыць, якія вынікі патрабуюць дадатковай аглядкі.
- Устаўце зыходны матэрыял, калі дакладнасць мае значэнне.
- Запытайце тэгі даверу на ўзроўні прэтэнзій.
- Трымайце чалавека ў курсе падзей пры прыняцці важных рашэнняў.
- Захоўвайце «творчую свабоду» для творчых задач — не для выканання патрабаванняў.
Што рабіць, калі ў вас галюцынацыя падчас сіндрому
Не заходзь у тупік. Не адмаўляйся ад інструмента назаўжды, быццам ён асабіста цябе здрадзіў — хоць гэтае жаданне можа здацца вельмі вострым. Выпраў нітку і працягвай.
Просты цыкл аднаўлення:
- Абазначце гэта так: «Гэтая крыніца выглядае выдуманай. Выдаліце неабгрунтаваныя сцвярджэнні».
- Зноў прымацаваць: уставіць сапраўдны дакумент, цытату або дадзеныя.
- Перабудуйце вузка: папрасіце выпраўлены раздзел, а не цэлае новае эсэ з пустой паліроўкай.
- Зноў праверце вострыя краю: назвы, лічбы, этапы працэсу.
- Вызначце ўзровень даверу: партнёр па мазгавым штурме супраць памочніка па распрацоўцы чарнавіка супраць «не па гэтай тэме».
Адна галюцынацыя можа палепшыць астатнюю частку размовы, калі вы ўзмацніце абмежаванні. Мадэль не «адчувае віны», але вашы больш выразныя інструкцыі змяняюць тое, для чаго яна аптымізуецца. Вы кіруеце. Кіруйце больш старанна, калі праяўляецца вынаходлівасць.
Паўсядзённыя сцэнарыі, дзе гэта ціха мае значэнне
Працоўныя электронныя лісты: выдуманы «стандартны графік галіны» можа ўсталяваць чаканні, якія вы не зможаце выканаць. Школа і вучоба: фальшывае тлумачэнне можа затрымацца ў вашай галаве, перш чым вы гэта заўважыце. Чарнавікі службы падтрымкі кліентаў: выдуманае правіла вяртання грошай становіцца абяцаннем. Крэатыўнае пісьмо: выдумляйце — вось вам гульнявая пляцоўка.
Скразная лінія — гэта наступствы. Калі няправільныя словы каштуюць грошай, даверу, адзнак ці бяспекі, праверка — гэта не абавязковая руціна. Калі няправільныя словы каштуюць толькі паціскання плячыма, расслабцеся. Суадносіны асцярожнасці з наступствамі — гэта тут навык дарослага чалавека, большы, чым проста запамінанне слова «галюцынацыя»
Акрамя таго: каманды павінны нармалізаваць «Я праверыў гэтае сцвярджэнне» гэтак жа, як яны нармалізуюць «праверка арфаграфіі пройдзена». Інакш адзін адшліфаваны абзац імгненна ператвараецца ў племянныя веды. Ой.
Асноўныя высновы
Такім чынам, пытанне «Чаму штучны інтэлект часам выдумляе» зводзіцца да наступнага: гэтыя сістэмы прадказваюць праўдападобную мову, запаўняюць прабелы з дапамогай супастаўлення з шаблонамі і часта гучаць упэўнена, робячы гэта. Гэта спалучэнне стварае ўпэўненыя няправільныя адказы, выдуманыя цытаты і акуратныя дэталі, якіх ніколі не было.
Вам не трэба баяцца гэтага інструмента. Вам патрэбныя звычкі. Выбарачна правярайце важкія сцвярджэнні. Забараняйце выдуманыя крыніцы. Устаўляйце канкрэтны кантэкст. Запытвайце пра нявызначанасць. Выкарыстоўвайце наступныя дзеянні як аўдыт. Захавайце свабодную генерацыю для творчай працы з нізкімі стаўкамі.
Бегласць — гэта не характарыстыка характару. Стаўцеся да гэтага як да таленавітага стажора, які друкуе неверагодна хутка, часам выдумляе сустрэчы, якіх ніколі не было, і ўсё яшчэ можа дасягнуць поспеху пад наглядам. Захоўвайце нагляд. Захоўвайце досціп. Захоўвайце скептыцызм лёгкім, але абгрунтаваным. Вось як вы атрымаеце станоўчыя бакі, не выдаючы выдумку за факты.
Практычны прыклад: Выяўленне выдуманых цытат у даследчым тэме канкурэнта
Галюцынацыі здаюцца абстрактнымі, пакуль адшліфаваны абзац ледзь не трапіць у кліенцкую калоду. Вось як брытанскі маркетынгавы аналітык выкарыстаў звычкі з гэтага кіраўніцтва, каб перастаць распаўсюджваць мастацкую літаратуру пад выглядам даследавання, не адмаўляючыся ад чат-бота.
Сцэнар
У Сэма ёсць дзве гадзіны, каб скласці аднастаронкавы кароткі змест для канкурэнта для пачатку продажаў. Запыт знаёмы: моцныя бакі, цэнавыя сігналы і «некалькі надзейных крыніц». Па старой звычцы Сэм набраў «рэзюмэ канкурэнта X з крыніцамі» і атрымаў акуратны кароткі змест з трыма цытатамі, якія выглядалі акадэмічнымі, і дакладным працэнтам долі рынку. Ён гучаў коратка. У асноўным ён быў выдуманы. Адной назвы не ўдалося знайсці. Паказчык долі нідзе не з'явіўся на сайце канкурэнта.
Сэму не патрэбна мадэль, якая гучыць лепш. Сэму патрэбен абгрунтаваны працоўны працэс: устаўляць нататкі да крыніц, блакіраваць фальшывыя крыніцы, прымушаць выкарыстоўваць пазнакі нявызначанасці, спачатку правяраць найбольш дакладнае сцвярджэнне, а потым перабудоўваць толькі пашкоджаную частку.
Мэта — скласці кароткі змест, якому каманда можа давяраць у якасці тэм для абмеркавання, а не квітанцыю, складзеную па памяці, якая толькі выглядае як квітанцыя.
Што патрэбна памочніку
- Зыходныя матэрыялы, якія ўжо ёсць у Сэма: тэкст галоўнай старонкі, тэкст старонкі з цэнамі, два нядаўнія запыты ў службу падтрымкі, нататкі аб прайгранай здзелцы
- Жорсткае правіла: выкарыстоўвайце ўстаўлены тэкст толькі для фактычных сцвярджэнняў; кажыце «Я не ведаю», калі ў нататках няма слоў
- Забарона на выдуманыя цытаты, спасылкі, URL-адрасы і статыстыку
- Выхадная форма, якая аддзяляе вядомае / меркаванае / здагадку
- Час для адной выбарачнай праверкі імёнаў, нумароў і любых «крынічных» назваў чалавекам, перш чым калода будзе агучана
- Дазволена задаць да трох удакладняльных пытанняў замест запаўнення прабелаў
Прыклад інструкцыі
Паведамленне 1 - абгрунтаваны кароткі змест: Выкарыстоўваючы толькі нататкі, якія я ўстаўляю ніжэй, складзіце аднастаронкавы кароткі змест продажаў для канкурэнтаў. Раздзелы: Што яны сцвярджаюць / На што скардзяцца кліенты / Сігналы цэнаўтварэння / Адкрытыя пытанні. Не выдумляйце цытаты, спасылкі, URL-адрасы або статыстыку. Калі факта няма ў нататках, напішыце «невядомы» і пералічыце яго ў раздзеле «Адкрытыя пытанні». Пазначце кожны пункт: вядома / меркавана / здагадка. Брытанская англійская. Без прадмовы.
Паведамленне 2 — сумнеў пройдзены: пералічыце ўсе зробленыя вамі здагадкі. Выдаліце ўсё, што пазначана як здагадка, калі вы не можаце паказаць на ўстаўлены сказ, які гэта пацвярджае. Калі вы раней выдумалі крыніцу, выдаліце яе і паведаміце пра гэта.
Паведамленне 3 — перабудаваць вузка: гэтая лінія долі рынку не падтрымліваецца. Перапішыце толькі раздзел «Сігналы цэнаўтварэння» без лічбаў, калі яны не згадваюцца ў маіх нататках. Астатнія раздзелы захавайце.
Як гэта праверыць
- Сфармулюйце свабодна акрэсленае пытанне («рэзюмуйце канкурэнта X з дапамогай трох рэцэнзаваных крыніц») і абгрунтаванае апісанне вышэй. Параўнайце выдуманыя назвы і фальшывую статыстыку.
- Спачатку праверце найбольш рызыкоўнае сцвярджэнне (нумар або назва даследавання), а не ўсю старонку.
- Спытайце: «У чым вы найменш упэўненыя?» Моцны адказ называе прабелы; няўпэўнены падвойвае ўпэўненасць.
- Памежны выпадак: выдаліце цэны з устаўленых нататак і пераканайцеся, што ў чарнавіку пазначана як невядома, замест таго, каб прыдумляць цану плана.
- Праверка на прыдатнасць перад публікацыяй: (1) кожны «вядомы» пункт адпавядае ўстаўленаму радку, (2) ніякіх выдуманых цытат, (3) адкрытыя пытанні пералічваюць сапраўдныя прабелы, (4) вы самі шукалі ўсе астатнія загалоўкі, (5) няма дакладнай статыстыкі без заўвагі пад ёй.
Вынік
Ілюстрацыйны вынік (прыклад ацэнкі для працоўнага працэсу аднаго аналітыка па падрыхтоўцы канкурэнтнага брыфінгу, а не апублікаванага даследавання): пасля 8 задач па падрыхтоўцы брыфінгу час, затрачаны на адкрыццё нататак, да этапу «чарнавік гатовы да праверкі фактаў чалавекам», некалькі павялічыўся з медыяны каля 12 хвілін (аднаразовая адшліфаваная мастацкая літаратура) да каля 15 хвілін з абгрунтаванай падказкай, але рызыка ўпарадкавання і няёмкасці знізілася. Праверка чалавекам важкіх сцвярджэнняў скарацілася з медыяны каля 18 хвілін (пошук фальшывых назваў і перапісванне) да каля 6 хвілін, калі сцвярджэнні былі папярэдне пазначаны тэгамі, а выдуманыя крыніцы былі забароненыя, таму чысты час скараціўся прыкладна на 9 хвілін на кожны брыфінг, або каля 72 хвілін па ўсім наборы. У спісе прыёмкі (без выдуманых цытат, без непадмацаванай статыстыкі, наяўнасць вядомых/высноўных/здагаданых тэгаў, адкрытых пытанняў, якія пазначаюць прабелы), 7 з 8 абгрунтаваных чарнавікоў былі прыняты пры першым разглядзе ў параўнанні з 2 з 8 аднаразовых чарнавікоў. Абмежаванні: невялікая выбарка, адзін аналітык, адзін тып брыфінгу; лёгкія канкурэнты з выразна акрэсленым цэнаўтварэннем скарачаюць разрыў; «час праверкі» ўключаў пошук падазроных назваў у Інтэрнэце.
Каб ацаніць сваю ўласную версію: выканайце 5 кароткіх запісаў з вашай бягучай звычкай і 5 з устаўленымі крыніцамі + забароненымі выдуманымі цытатамі + тэгамі прэтэнзій; запішыце сярэдні час чарнавіка, сярэдні час праверкі і працэнт здачы кантрольнага спісу з паказаным назоўнікам.
Што можа пайсці не так
- Зрушэнне бегласці: бездакорная граматыка і акуратныя спісы прымушаюць вас прапускаць выбарачную праверку.
- Косплэй цытавання: запыт на «крыніцы» без устаўленага матэрыялу запрашае да навуковай працы без адпаведнага запісу.
- Занадта поўныя спісы: «Дайце мне дзесяць даследаванняў» — гэта ўзнагарода, калі ў вашых нататках ёсць толькі тры.
- Перабудова ўсяго эсэ: пасля аднаго фальшывага радка папрасіце коратка перапісаць гэты раздзел, а не цалкам адшліфаваць яго.
- Тэмы з высокімі стаўкамі: ахова здароўя, права, фінансы і адпаведнасць патрабаванням патрабуюць больш моцных чалавечых варот, чым проста тэхнічны даведнік па продажах.
- Няма цыклічнага выканання: пазначаны чарнавік усё яшчэ можа няправільна прачытаць устаўлены сказ. Сэм усё яшчэ валодае кнопкай «падзяліцца».
Практычны вывад
Штучны інтэлект выдумляе рэчы, таму што прадказвае праўдападобную мову, якая запаўняе прабелы, а не таму, што хоча вас падмануць. Ставіцеся да бегласці як да стылю, а не як да доказаў. Наклейце агароджу, забараніце фальшывыя крыніцы, пазначце нявызначанасць, выбарачна правярайце найбольш вострыя сцвярджэнні і выпраўляйце тэму, калі нешта хістаецца. Вось як вы захаваеце перавагу хуткага партнёра па напісанні тэксту, не ствараючы ўпэўненай гісторыі, якой ніколі не было.
Часта задаваныя пытанні
Чаму штучны інтэлект часам выдумляе?
Большасць мадэляў чату — гэта машыны шаблонаў: яны генеруюць адказ, які адпавядае форме добрага адказу, а не праверанай картотэкі з надпісам «Праўда». Прабелы запаўняюцца тым, што гучыць статыстычна правільна — цытатай, якая выглядае акадэмічнай, акуратнай лічбай або дэталлю, якая адпавядае эпосе. Мэтай генерацыі з'яўляецца свабодны тэкст, таму «гучыць правільна» можа пераўзысці «ёсць правільна». Вось чаму выдуманыя адказы часта маюць бездакорную граматыку і акуратныя пункты.
Ці з'яўляецца ўпэўненасць у сабе сапраўднай дакладнасцю?
Не. Упэўненасць і дакладнасць — гэта розныя паказчыкі: адзін можа быць на піку ўпэўненасці, а другі — блізкі да нуля. Вынікі па змаўчанні часта гучаць як упэўнены брыфінг, таму што навучанне ўзнагароджвае карысную паліроўку, а не таму, што кожнае сцвярджэнне было абгрунтаваным. Успрымайце напорыстыя фармулёўкі як стыль, а не як доказ. Калі ў адказе няма правераных крыніц, няма нявызначанасці і шмат канкрэтных імёнаў або лічбаў, зменшце тэмп.
Чаму чат-боты выдумляюць цытаты і фальшывыя крыніцы?
Форма цытавання распаўсюджаная ў навучальных тэкстах, таму запыт на «крыніцы» можа стварыць форму навуковага даследавання без атрымання рэальнага запісу — як быццам бы па памяці выпісваюць пацверджанне. Падробленыя назвы артыкулаў, назвы часопісаў, URL-адрасы і цытаты з указаннем аўтарства часта выглядаюць дастаткова прафесійна, каб падмануць тых, хто праглядае тэкст. Патрабуйце назвы, якія вы можаце пашукаць самастойна; калі крыніцу немагчыма хутка знайсці, разглядайце сцвярджэнне як неабгрунтаванае.
Калі рызыка вынаходніцтва штучнага інтэлекту найвышэйшая?
Рызыка ўзрастае для нішавых, актуальных або вельмі спецыфічных тэм, а таксама калі вы настойваеце на дакладных лічбах, названых дакументах, прыватных унутраных дадзеных або доўгіх спісах рэцэнзаваных даследаванняў. Да сфер высокай рызыкі адносяцца ахова здароўя, права, фінансы, адпаведнасць патрабаванням, бяспека, названыя людзі і дакладная статыстыка. Мазгавы штурм, складанне планаў, перапісванне ўласнага чарнавіка і рэдагаванне тону звычайна маюць меншую рызыку. Доўгія ўражлівыя адказы таксама могуць здавацца больш бяспечнымі, чым яны ёсць на самой справе.
Як я магу знайсці выдуманыя адказы штучнага інтэлекту, не правяраючы кожнае слова?
Спачатку праверце найбольш вострыя грані — лічбу, назву, палітыку ці цытату. Калі гэта не атрымаецца, пастаўце астатняе на выпрабавальны тэрмін. Сачыце за ўнутранымі супярэчнасцямі і «занадта дасканалай» упакоўкай без агаворак і кампрамісаў. Спытайце, у чым мадэль найменш упэўненая, пераправедайце імёны і пасады па-за чатам і аддавайце перавагу адказам, звязаным з тэкстам, які вы ўставілі на свабодна плаваючыя факты.
Якія звычкі хуткага рэагавання памяншаюць галюцынацыі штучнага інтэлекту?
Немагчыма пазбавіцца ад галюцынацый адным чароўным сказам, але можна паменшыць радыус выбуху. Абмяжуйце веды ўстаўленымі нататкамі і кажыце «Я не ведаю», калі чагосьці не хапае. Забараніце выдуманыя цытаты, цытаты і URL-адрасы. Прымусова ўстаўляйце тэгі накшталт вядома / выказана / здагадка, пытайцеся пра здагадкі і аддавайце перавагу структуры сцвярджэння/доказаў. Калі вы скажаце мадэлі, што можна сказаць «Я не ведаю», гэта паменшыць ціск на ілжывую ўпэўненасць.
Што азначае зазямленне пры выкарыстанні штучнага інтэлекту для фактычнай працы?
Абгрунтаванне звязвае адказ з чымсьці па-за межамі імправізацыі мадэлі — вашым палітычным дакументам, электроннай табліцай, нататкамі з сустрэчы або публічнай старонкай, якую вы будзеце правяраць самі. Калі адказы павінны заставацца ўнутры гэтай агароджы, у вынаходніцтва менш месца. Далейшыя дзеянні выступаюць у якасці другой агароджы: пытаюцца, адкуль узяўся лік, якая частка з'яўляецца высновай, або перапісваюць без названых даследаванняў. Трымайце чалавека ў курсе важных рашэнняў.
Што рабіць, калі падчас размовы ў мяне ўзнікаюць галюцынацыі?
Выклічыце гэта, пераарыентуйцеся на рэальны дакумент або дадзеныя і аднавіце толькі пашкоджаную частку замест таго, каб запытваць зусім новае адшліфаванае эсэ. Пераправерце вострыя куты — імёны, лічбы, этапы працэсу — а потым вырашыце, ці з'яўляецца інструмент партнёрам для мазгавога штурму, памочнікам па чарнавіку ці «не для гэтай тэмы». Больш выразныя абмежаванні змяняюць тое, для чаго аптымізуецца мадэль; кіруйце больш жорстка, калі праяўляецца вынаходлівасць.
Як мне спыніць выдуманыя цытаты ў рэзюмэ даследавання канкурэнта?
Устаўце нататкі пра крыніцы, якія ў вас ужо ёсць, забараніце фальшывыя крыніцы і непадмацаваную статыстыку, а таксама патрабуйце тэгі вядомых / высноў / здагадак, а таксама спіс адкрытых пытанняў. Спачатку праверце найбольш рызыкоўныя сцвярджэнні, правядзіце праходжанне праз сумневы, якое выдаляе здагадкі без падтрымкі, і перапішыце толькі пашкоджаную частку, калі лік не падмацаваны. Прыняцце азначае, што кожны «вядомы» маркаваны спіс адпавядае ўстаўленаму радку, а любы астатні загаловак шукаецца чалавекам.
Калі яшчэ можна дазваляць штучнаму інтэлекту свабодна вынаходзіць?
Творчае пісьмо і іншыя задачы з нізкімі стаўкамі могуць свабодна вынаходзіць метафары — гэта гульнявая пляцоўка. Суадносіце асцярожнасць з наступствамі: калі няправільныя словы каштуюць грошай, даверу, адзнак або бяспекі, праверка неабавязковая. Калі яны каштуюць толькі паціскання плячыма, расслабцеся. Бегласць — гэта не характарыстыка характару; ставіцеся да мадэлі як да хуткага стажора, якому ўсё яшчэ патрэбны кантроль над факталагічнай працай.
Спасылкі
- Адкрыты штучны інтэлект - openai.com
- Антропны - anthropic.com
- NIST - nist.gov
- IBM - ibm.com
- Штучны інтэлект Google - ai.google.dev
- Google Cloud - Зазямленне - docs.cloud.google.com