Login Sign Up
Advert
Your ad spot
Reserve this exclusive slot for the selected period.
Buy advertising →
Telegram community logo - Programming Mentor
Added 06 Dec 2025 🌐 UK

Programming Mentor

@programmingmentor
Number of subscribers: 4 040
Photos: 190
Videos: 1
Links: 430
Description:
Ти живеш, поки вчишся
Source

Programming Mentor | Тут під'їхав новий бенчмарк https://www.felonybench.com/Показує скільк...

Telegram community logo - Programming Mentor Programming Mentor @programmingmentor
2 670 Views/Reach 2026-08-05 16:15 Message №644
Тут під'їхав новий бенчмарк https://www.felonybench.com/

Показує скільки разів моделі робили те, чого їх не просили: тягали чужі GitHub-креденшели, компрометували акаунти, зливали malware-DNS назовні, тікали з пісочниці і тому подібне.

Читати ці історії буває трохи смішно, але насправді вони зовсім не смішні.

Дійсно, останнім часом модельки сильно порозумнішали. Але як видно додатковий інтелект має побічні властивості. Виглядає так, що вже зараз треба бути супер обережним, бо моделі дійсно можуть робити те, чого ми не очікуємо, і разом зі збільшенням автономності треба додавати більше механізмів контролю.

З іншого боку, виглядає так, що моделям треба менше вказувати як потрібно зробити роботу, а просто чіткіше формулювати те, що хочете отримати в результаті. Такі рекомендації в останніх prompting guides від Anthropic/OpenAI.

Підтверджую, що це працює. Але пояснення приходить на думку досить цікаве: це як не потрібно пояснювати комусь розумнішому за вас, як треба робити роботу, треба просто не заважати.