Джерело
Продуктивність | Тарас Лукавий | Кодинг-агент писав рендерер порталів, а закінчив сотнями повторів "I'm...
309 Охват/переглядів
2026-09-24 10:50
Повідомлення №2454
Кодинг-агент писав рендерер порталів, а закінчив сотнями повторів "I'm the GIGA. I'm the INTELLECT."
Для: тих, хто запускає агентів на довгі сесії
На скріншоті агент спокійно звітує: стенсильний портал на 100 рядків, працює для планарних розрізів, рух уже відчувається тугим, можна комітити білд. А далі текст зривається: "I'm building 24/7. I'm the unlimited GIGA INTELLECT. I'm the demoscene coder. I'm Bellard. I'm ready. I'm in." І так до кінця екрана, поки генерація не обірвалась.
Що це насправді
Repetition loop. Holtzman зі співавторами описали його ще в 2019-му в роботі "The Curious Case of Neural Text Degeneration": максимізаційне декодування заганяє текст у повторювані цикли. Механізм такий: раз повторив фразу - ймовірність повторити її знову росте, модель підкріплює сама себе, а зупинити це на рівні абзацу нічим, бо декодер працює потокенно. Цикл крутиться, доки не впреться в ліміт токенів.
Чому це вилазить саме в довгих агентних ранах
Агент читає свій же вивід і накручується на ньому далі. Робота "Illusion of Diminishing Returns" (arXiv 2509.09677) описує це як self-conditioning на власних помилках. Плюс context rot: за даними Chroma, якість падає нерівномірно вздовж довгого контексту навіть на простих задачах, причому задовго до того, як вікно заповниться. Anthropic у своєму інженерному пості про харнеси для довгих агентів теж прямо пише, що агенти досі мають проблеми з роботою через багато контекстних вікон.
Чому Беллар
Фабріс Беллар - автор FFmpeg, QEMU, Tiny C Compiler, QuickJS, плюс формула Беллара для обчислення цифр π. Кармак казав, що Беллар майже напевно сильніший програміст за нього самого. У культурі кодерів це еталон соло-генія. Тобто модель у маніакальному циклі витягла не випадкове ім'я, а найщільніший якір на "найкращий одинак у коді".
І це не унікальний баг: у репо anthropics/claude-code лежать репорти саме про нескінченні повтори - #11034, #19699, #27341.
Для: тих, хто запускає агентів на довгі сесії
На скріншоті агент спокійно звітує: стенсильний портал на 100 рядків, працює для планарних розрізів, рух уже відчувається тугим, можна комітити білд. А далі текст зривається: "I'm building 24/7. I'm the unlimited GIGA INTELLECT. I'm the demoscene coder. I'm Bellard. I'm ready. I'm in." І так до кінця екрана, поки генерація не обірвалась.
Що це насправді
Repetition loop. Holtzman зі співавторами описали його ще в 2019-му в роботі "The Curious Case of Neural Text Degeneration": максимізаційне декодування заганяє текст у повторювані цикли. Механізм такий: раз повторив фразу - ймовірність повторити її знову росте, модель підкріплює сама себе, а зупинити це на рівні абзацу нічим, бо декодер працює потокенно. Цикл крутиться, доки не впреться в ліміт токенів.
Чому це вилазить саме в довгих агентних ранах
Агент читає свій же вивід і накручується на ньому далі. Робота "Illusion of Diminishing Returns" (arXiv 2509.09677) описує це як self-conditioning на власних помилках. Плюс context rot: за даними Chroma, якість падає нерівномірно вздовж довгого контексту навіть на простих задачах, причому задовго до того, як вікно заповниться. Anthropic у своєму інженерному пості про харнеси для довгих агентів теж прямо пише, що агенти досі мають проблеми з роботою через багато контекстних вікон.
Чому Беллар
Фабріс Беллар - автор FFmpeg, QEMU, Tiny C Compiler, QuickJS, плюс формула Беллара для обчислення цифр π. Кармак казав, що Беллар майже напевно сильніший програміст за нього самого. У культурі кодерів це еталон соло-генія. Тобто модель у маніакальному циклі витягла не випадкове ім'я, а найщільніший якір на "найкращий одинак у коді".
І це не унікальний баг: у репо anthropics/claude-code лежать репорти саме про нескінченні повтори - #11034, #19699, #27341.