Интернет заполняется текстом, который никто не писал. SEO-статьи, комментарии, посты в соцсетях всё чаще рождаются в недрах языковых моделей, а не в головах живых людей. Нью-йоркский стартап Pangram, основанный выпускниками Стэнфорда Максом Сперо и Брэдли Эми, привлёк $9 миллионов от Menlo Ventures на борьбу с этим явлением и одновременно выпустил новую модель детекции — Pangram 4, а также детектор AI-изображений.
Точность нового текстового детектора превышает 99%, включая случаи, когда человек слегка отредактировал сгенерированный текст или пытался обмануть систему через AI-«гуманайзеры». Технология не полагается на метаданные или скрытые водяные знаки — модель обучена на десятках миллионов человеческих текстов и их «синтетических зеркалах», написанных передовыми LLM на ту же тему, того же объёма и в том же тоне. Система улавливает стилистические паттерны, которые языковые модели воспроизводят с математической предсказуемостью.
Журналист TechCrunch лично протестировал инструмент: Pangram уверенно ловил полностью сгенерированные статьи и не поддавался на попытки обмануть детектор через промпты. Но были и слабые места — модель иногда ошибочно помечала полностью переписанные человеком фразы как AI-текст, особенно в новостных материалах с суховатым стилем. Тест детектора изображений также прошёл успешно, включая обнаружение AI-картинки, встроенной внутрь настоящей фотографии.
Спрос на такие инструменты растёт не из любопытства. ArXiv в этом году ввёл годовой бан на публикации для авторов, чьи статьи содержат следы непроверенного вывода языковых моделей — вроде фразы «Хотите, я что-то поправлю?», случайно оставленной в тексте. Юристы получают санкции судов за придуманные ChatGPT судебные прецеденты. Pangram уже встроен в Substack и Quora, его используют школы, университеты и рекрутеры. Сперо формулирует ставку жёстко: GPU производятся быстрее, чем рождаются люди, и без механизмов различения человеческого контента интернет рискует утонуть в шуме, где не останется места для настоящего авторского голоса.
Во что углубиться:
- Что такое AI slop и почему поисковики и соцсети борются с этим явлением
- Как работают конкуренты Pangram — GPTZero, Originality.ai, Copyleaks
- Новые правила arXiv и научных изданий по проверке AI-контента в публикациях
