← На главную

Фредди деБур: Pangram ставит 100% AI тексту человека при смене контекста

23.07.2026 15:33 · hackernews

Фредди деБур столкнулся с обвинением: ему заявили, что фрагмент его старого поста на 300 слов написан машиной. Инструмент Pangram пометил этот кусок как «100% AI» с высокой уверенностью. ДеБур купил платную лицензию Pangram и проверил весь текст. Тот же сервис признал эссе целиком «100% человеческим», причём тоже с высокой уверенностью, хотя внутри него сидел «100% AI»-фрагмент. Дальше он разрезал «AI»-отрывок на куски поменьше, и Pangram назвал их «100% человеческими». Получилась матрёшка из взаимоисключающих вердиктов.

Экспериментируя, деБур выяснил, что результат радикально зависит от контекста. Он брал текст, написанный ChatGPT, вставлял его в большое человеческое эссе — и Pangram выдавал «100% human». И наоборот: собственноручно написанный абзац, окружённый машинной портянкой, система объявляла «100% AI». Процентная шкала, по его наблюдениям, практически всегда показывает полярные значения, хотя должна отражать долю подозрительного текста. Он привёл конкретный пример: к отрывку из своей статьи 2017 года дописал три предложения от ChatGPT, так что машинный текст составил 23% по числу слов. Pangram заявил «100% AI» с высокой уверенностью, хотя три четверти написал человек.

ДеБур легко провоцирует ложные срабатывания. Он за 15 минут сочинил абзац про школьные обеды, намеренно избегая штампов вроде «delve», и Pangram тут же определил его как «100% AI». Это значит, что детектор реагирует не на авторство, а на поверхностные закономерности, которые некоторые люди могут воспроизводить случайно — например, авторы с неродным английским или те, кто пишет в шаблонной манере. При огромном объёме публикуемых текстов даже заявленная Pangram низкая частота ложных срабатываний (0,19%) гарантирует массу несправедливых обвинений. Сам деБур с 2022 года опубликовал около 1200 постов, а это тысячи абзацев, каждый из которых — отдельный шанс попасть под раздачу.

Конкретный пост, из-за которого разгорелся сыр-бор, деБур называет почти идеально неподходящим для машинной генерации: странные образы вроде «Lisa Frank sticker crying blood» и «universal rabbi of liberal virtue», сугубо личный эксперимент со стилем, написанный без всякого коммерческого расчёта. Он предупреждает: большинство авторов не смогут так же хладнокровно отбиваться от подобных обвинений, потому что у них нет его многолетнего опыта, уверенности и денег на платный аккаунт. Pangram может быть полезным инструментом, но применять его нужно с эпистемологической скромностью — технология слишком молода, а цена ошибки для репутации конкретного человека непомерно высока.

Читать оригинал →