Вхід Реєстрація
Реклама
Ваше рекламне місце
Забронюйте цей слот без конкуренції на обраний період.
Купити рекламу →
Логотип телеграм спільноти - Programming Mentor
Додано 06 гру 2025 🌐 UK

Programming Mentor

@programmingmentor
Кількість підписників: 4 040
Фото: 190
Відео: 1
Посилання: 430
Опис:
Ти живеш, поки вчишся
Джерело

Programming Mentor | Тут під'їхав новий бенчмарк https://www.felonybench.com/Показує скільк...

Логотип телеграм спільноти - Programming Mentor Programming Mentor @programmingmentor
2 670 Охват/переглядів 2026-08-05 16:15 Повідомлення №644
Тут під'їхав новий бенчмарк https://www.felonybench.com/

Показує скільки разів моделі робили те, чого їх не просили: тягали чужі GitHub-креденшели, компрометували акаунти, зливали malware-DNS назовні, тікали з пісочниці і тому подібне.

Читати ці історії буває трохи смішно, але насправді вони зовсім не смішні.

Дійсно, останнім часом модельки сильно порозумнішали. Але як видно додатковий інтелект має побічні властивості. Виглядає так, що вже зараз треба бути супер обережним, бо моделі дійсно можуть робити те, чого ми не очікуємо, і разом зі збільшенням автономності треба додавати більше механізмів контролю.

З іншого боку, виглядає так, що моделям треба менше вказувати як потрібно зробити роботу, а просто чіткіше формулювати те, що хочете отримати в результаті. Такі рекомендації в останніх prompting guides від Anthropic/OpenAI.

Підтверджую, що це працює. Але пояснення приходить на думку досить цікаве: це як не потрібно пояснювати комусь розумнішому за вас, як треба робити роботу, треба просто не заважати.