В исследовании Graphite Claude Opus 5.5 реже использовала тире, но сохранила другие языковые отличия
Сравнение 9 974 пар текстов показало меньшее расхождение Opus 5.5 с человеческим корпусом, чем у Opus 5. Однако авторы отмечают методические ограничения и тысячи устойчивых «AI-признаков».
Сравнение десяти моделей и авторов
Агентство Graphite сравнило статьи десяти моделей и человеческие тексты по 9 974 совпадающим темам. В анализ добавили Claude Opus 5.5. Показатель расхождения распределения слов с человеческой выборкой у новой модели составил 0,052 против 0,064 у Opus 5 — снижение на 19%. У GPT-6 Astra он, напротив, вырос до 0,109 с 0,101 у GPT-5.6 Sol. Это метрика различия корпусов, а не универсальная оценка качества текста.
Тире стало реже, другие привычки остались
Graphite насчитала у Opus 5.5 0,015 длинного тире на тысячу слов против 2,92 у Opus 5, то есть примерно на 99% меньше. Но исследователи выявили 2 548 слов, выражений и конструкций, встречавшихся в текстах Opus 5.5 как минимум вдвое чаще, чем в сопоставимых человеческих статьях. Оценка «вычурной прозы» тоже снизилась на 37%, но оставалась выше показателя человеческой выборки.
Ограничения сравнения
Авторы подчёркивают, что модели не получали специальных инструкций имитировать людей или избегать узнаваемых оборотов. Результат может измениться при другом запросе, редактировании человеком или другой задаче. Человеческие тексты в сравнении старше сгенерированных и датированы периодом с 2022 года, поэтому различия в интернет-стиле со временем могли повлиять на выводы. Оценка вычурности также могла зависеть от модели-судьи.