Погляд Anderson

Індустріалізація гуманізації

mm
Додайте Unite.AI до бажаних джерел у Google
Based on 'X-Ray of a Human Head and Neck' by Rohit Choudhari, under Unsplash license. Subsequently amended by GPT Image 2.5 to include cybernetic component. Source for original image: https://unsplash.com/photos/x-ray-of-a-human-head-and-neck-xZZNVtCYVEM License: https://unsplash.com/license

Оголошення про підробіток і пропозиції послуг на таких неформальних платформах, як Upwork і Fiverr, сьогодні активно містять слово ‘humanize’, при цьому різноманітні роботи та виконавці пропонують різні рівні приховування факту, що стаття була написана, або частково написана, або співавтором, за допомогою ШІ.

Тенденція 'Humanize' у реальних оголошеннях на Upwork.

Тенденція ‘Humanize’ у реальних оголошеннях на Upwork.

Попит на людські та автоматизовані послуги, які можуть переписати «забруднений» ШІ контент так, щоб здавалося, що людина сіла і працювала кілька годин, свідчить про те, що досягнуто універсальної згоди щодо того, що «людський дотик» потрібен для зв’язку та охоплення — і що величезний обсяг контенту в епоху ШІ знову зробить цей зв’язок необхідним.

Я б особисто хотів так думати, але це не обов’язково так — не в останню чергу тому, що власні рекомендації Google щодо цього розгляд якість тексту, а не засобів, якими він був створений.

Правда в тому, що ми наразі точно не знаємо скільки і який саме ШІ ми готові терпіти, або в якій мірі можемо виправдати переваги, які мільярди з нас отримують від ШІ щодня, проти відчуття «співучасті» та морального спокушання щодо ширших наслідків технології.

Зазначені вище оголошення про роботу теж це відображають; там творці та компанії жадібно прагнуть автоматизації, ймовірно, тому що хочуть публікувати в масштабі, що саме те, що Google обіцяє спеціально карати у своєму алгоритмі ранжування. Водночас вони шукають як автоматизовані, так і людські методи «індустріалізації» гуманізації.

Це трохи нагадує один з найкращих жартів у нейрорізноманітних комедійних номерах Стівена Райта 1980‑х років:

‘У моєму будинку є мікрохвильовий камін. Я можу розташуватися перед вогнем на вечір всього за 8 хвилин.’

Форма майбутнього slop

Як завжди, ці роздуми натхненні моїм щоденним переглядом Arxiv, де сьогодні я особливо натрапив на статтю Джохена Мадлера з компанії з маркетингової автоматизації Sitefire, під назвою SlopShape: Identifying AI-Generated Commercial Web Content.

Зазвичай я ігнорую статті з одним автором, керуючись принципом «Віктор Франкенштейн», але передумова цієї роботи спартанська, а методологія тестування — надійна.

Дослідження по суті стверджує, що коли пост, згенерований ШІ, повністю переписується, навіть людьми, він зберігає виразний архітектурний підпис, який розташовується на рівні значно вище, ніж рівень слів, і включає характерну «форму», яку неможливо усунути жодним перефразуванням чи поверхневими правками тексту:

Порівняння структурних патернів у людських та ШІ‑написаних постах. Людське письмо схильне до рідкісних комбінацій структур, тоді як усі п'ять моделей ШІ віддають перевагу більш конвенційним комбінаціям. Джерело - https://arxiv.org/pdf/2609.15369

Порівняння структурних патернів у людських та ШІ‑написаних постах. Людське письмо схильне до рідкісних комбінацій структур, тоді як усі п’ять моделей ШІ віддають перевагу більш конвенційним комбінаціям. Джерело

Очевидно, можна обійти цю проблему (якщо вважати її проблемою), фактично плануючи процес написання самостійно і або не використовуючи ШІ взагалі, або застосовуючи його лише до окремих компонентів, які ви запланували самостійно.

Проте, як свідчать агресивні оголошення на Upwork, це не те, що потрібно; можна зрозуміти з тону таких оголошень, що контент статей повинен, бажано, не лише структуруватися ШІ, а й запропонований ШІ — іншими словами, що LLM пропонує відповідні теми, узгоджені з загальними цілями компанії чи організації.

Після цього цілком очікується, що ШІ створить різні прогресивні чернетки контенту, причому дратівливий «м’ясний» компонент втручається лише для завершальної та випадкової нотки людяності (хоча в ідеалі цей процес зрештою перетвориться на робочий процес у Python).

Видатні особливості

Автор нової статті отримав ці висновки, зібравши кілька тисяч блогових постів компаній, що передували випуску та поширенню ChatGPT (2020‑2022), і вивівши з них підказки.

Тобто, він використав Gemini 3 Flash для читання реальних, написаних людьми статей та зворотного інжинірингу підказки, розробленої для створення подібної роботи на деяких провідних LLM, а саме GPT5.4, Kimi 2.5, DeepSeek V3.2, Claude 4.6 та Gemini 3.

Ці підказки потім використали для створення п’яти ШІ‑версій кожного реального людського посту, з яких були вилучені особливості, що зрештою описують специфічну для LLM «форму» контенту в усіх п’яти моделях; і Мадлер зазначає, що «ШІ‑пости мають акуратну, самопояснювальну форму».

Усе дослідження — це повторний запуск проекту StoryScope з COLM 2026 у серпні, спільної ініціативи Університету Меріленду та Google DeepMind, яка застосувала практично ту ж методологію до художньої літератури, виявивши, що історії, створені ШІ, збігаються до більш вузького та передбачуваного діапазону наративних структур, ніж людське письмо:

З дослідження StoryScope — порівняння розсіяння графіком наративних патернів у людській та створеній ШІ художній літературі. Людські історії займають окрему область, тоді як історії п'яти провідних моделей ШІ згруповані ближче один до одного, що свідчить про більшу схожість у їхніх базових наративних виборах. Джерело — https://arxiv.org/pdf/2604.03136

З дослідження StoryScope — порівняння розсіяння графіком наративних патернів у людській та створеній ШІ художній літературі. Людські історії займають окрему область, тоді як історії п’яти провідних моделей ШІ згруповані ближче один до одного, що свідчить про більшу схожість у їхніх базових наративних виборах. Джерело

Мадлер вирішив повторно запустити StoryScope для корпоративних блогів через значний фінансовий стимул автоматизувати їх, у порівнянні з більш ексцентричною сферою художнього письма, а також через те, наскільки вже автоматизовано ці блоги (50 % автоматизації онлайн‑контенту станом на травень 2026 року, згідно з дослідженням Graphite, наведеним у роботі Мадлера).

Можливо, найцікавіший аналіз — це розбір ознак, витягнутих із матеріалу, створеного ШІ, на основі дописів, написаних людьми до 2022 року:

«Значення, які найчастіше генеруються моделями ШІ, формують те, що ми називаємо акуратним, самопояснювальним блог‑постом: він обіцяє результат уже в заголовку, формулює тезу та анонсує структуру перед першою секцією, пише в тоні редакційного пояснювача і завершується етапом, що підсумовує або повторює тезу.»

«У типічному пості ШІ результат обіцяється в заголовку: “Як скоротити час адаптації вдвічі”. Теза формулюється, а хід викладу анонсується перед першою секцією: “У цьому пості ми розглянемо, чому процес адаптації затримується, три дієві рішення та як виміряти різницю.”»

«А завершення повторює тезу: “Коротко, структурована адаптація економить час”. Людські орієнтовані цінності описують дописи без цих орієнтирів: немає анонсованого потоку секцій, немає підвищення ставок і немає заключної секції, що повторює тезу.»

Помилкове припущення

До речі, більшість тропів і кліше, присутніх у описаних шаблонах, походять від обмежень, одержимих SEO епохи маркетингу до появи LLM. Де, на нашу думку, ШІ навчився цим звичкам?

Шаблонований маркетинговий копірайт завжди ненавиділи, задовго до ШІ, і його завжди створювали у масштабі, задовго до того, як машини могли це робити добре; і через вимогу відповідати практикам SEO були встановлені жахливі конвенції, такі як розташування ключових слів та ретельно продуманий дизайн посилань.

У цьому випадку ШІ, ймовірно, засвоїв неправильний урок, оскільки текстові корпуси, на яких його навчали, видалили безліч SEO‑орієнтованих тактик, що спочатку входили до вихідного матеріалу, таких як стратегічні діаграми, візуальні пояснювачі; і, особливо, гіперпосилання.

Цілі розділи статті могли бути створені для розміщення гіперпосилання або вбудованого відео YouTube, яке клієнт хотів просунути; проте до моменту, коли дані були використані для навчання LLM, вбудовування або посилання були видалені, а текст, призначений їх підкреслити, залишився без початкового контексту.

Отже, можна стверджувати, що головна помилка у розробці методологій навчання на такому матеріалі полягала в тому, що веб‑контент розглядали ніби це література XIX століття (повністю самодостатня), а не мультимедіа (значно впливане нетекстовими факторами, такими як відео, гіперпосилання та ілюстрації).

Іншою великою помилкою було навчання на матеріалі який вже ненавиділи люди, і який був викривлений у свою непопулярну форму правилами, що ймовірно більше не є дійсними.

Увага, людино

Проте, якщо вірити тенденціям Upwork, існує значний попит на ще більше подібного, створеного у масштабі LLM і «гуманізованого» найменш ідіосинкразним доступним процесом, з максимальною швидкістю та мінімальними витратами.

Сприйняття отримання людської уваги має для нас значення: ідея, що хтось, подібний до вас (тобто, принаймні, володіючий ендокринною системою), сів на кілька годин і розмірковував, що саме сказати вам.

Сприйняття отримання людської уваги має для нас значення навіть коли це не корисно; тому це безумовно варто індустріалізувати.

Не можу не відчувати, що стаття Мадлера якимось чином, ймовірно, погіршить ситуацію, оскільки вона виявляє характерні багатовимірні риси, які тепер, імовірно, можна вирішити за допомогою більше ШІ, так що типові підписи набудуть більш людської форми у міру еволюції моделей.

 

Вперше опубліковано у четвер, 17 вересня 2026 року

Письменник про машинне навчання, спеціаліст у галузі синтезу людських зображень. Колишній керівник дослідницького контенту в Metaphysic.ai, до його розформування в DNEG's Brahma.ai.
Портфоліо сайт: martinanderson.ai
Контакт: martin@martinanderson.ai