Fuente
Великий PR | Добрався до вересневого звіту Антропік про зловживання ШІ “Detecting a...
150 Vistas/Alcance
2026-09-21 06:42
Mensaje №791
Добрався до вересневого звіту Антропік про зловживання ШІ “Detecting and countering misuse of AI: September 2026” лише зараз. Уважно вивчив частину щодо визначення та протидії операціям впливу з використанням Клоду.
Ну, нічого нового під місяцем – люди лишилися людьми, пропаганда - пропагандою, а от інструменти покращуються, стають різноманітнішими та технологічнішими.
Цікаве чтиво на вечір і пару фактів:
• Моделі створюють потужний uplift (буст можливостей), дозволяючи зловмисникам діяти набагато швидше, масштабніше і з мінімальними ресурсами.
• Операції впливу продаються як сервіс або держави використовують комерційні “прокладки” (як ось в цьому випадку рф) для того, щоби спростровувати власну причетність.
• Метод боротьби Антропіка з таким використанням – його величність БАН.
• “Ми ідентифікували та видалили чотири акаунти, в яких окремі особи використовували Claude як редакційний та новинний відділ для поширення контенту через російські державні медіа-ресурси.” Наламали якимось руським так званим журналістам спрощення роботи їх роботи. Норм.
Але субʼєкти знаходять способи приховати походження своєї ідентичності. Це починалося вже на етапі створення контенту: зловмисники просили модель прибрати сліди автоматизованого тексту й зробити його природним, створювали логіку «прогріву» акаунтів та обходу захисту, а також видаляли метадані й кодові назви перед передачею. Вони також «відмивали» свій доступ до самого Claude через VPN, іноземні номери телефонів, ротацію акаунтів та сторонні сервіси, які маскували їхню IP-адресу.
• Звичайно, достатньо прикладів дій РФ з цілого світу, ось наприклад радіо в Центральноафриканській республіці:
Ми видалили акаунт, яким керував російськомовний актор у Бангі, що забезпечував виробничу основу для пов'язаної з російською державою операції з маніпулювання та втручання в інформацію з-за кордону (FIMI), спрямованої проти Центральноафриканської Республіки (ЦАР).
Актор здійснював щоденну контент-операцію через «Radio Lengo Songo» (98.9 FM), координуючи її з російськими державними медіа-ресурсами RT, Sputnik Afrique і ТАСС, а також із «Русским домом» у Бангі. Щоразу, коли користувач генерував контент, він чітко інструктував Claude впроваджувати в історії проросійські та антифранцузькі наративи. Щоб забезпечити абсолютну правдоподібність заперечення (причетності), вони змушували модель позбуватися класичних звичок форматування, активно перешкоджаючи тому, щоб стрічки новин виглядали як синтетичний текст, згенерований штучним інтелектом. Більшість вибірки зразків активності складалася з проурядових наративів ЦАР, провагнерівських, антифранцузьких та опозиційних до уряду ЦАР наративів.
• Антропік зазначає, що “Операції впливу часто не досягають реальної аудиторії.” Як на мене трохи самовпевнено, ну і не завжди це основна і пряма мета таких ШІ-комунікацій.
Ну, нічого нового під місяцем – люди лишилися людьми, пропаганда - пропагандою, а от інструменти покращуються, стають різноманітнішими та технологічнішими.
Цікаве чтиво на вечір і пару фактів:
• Моделі створюють потужний uplift (буст можливостей), дозволяючи зловмисникам діяти набагато швидше, масштабніше і з мінімальними ресурсами.
• Операції впливу продаються як сервіс або держави використовують комерційні “прокладки” (як ось в цьому випадку рф) для того, щоби спростровувати власну причетність.
• Метод боротьби Антропіка з таким використанням – його величність БАН.
• “Ми ідентифікували та видалили чотири акаунти, в яких окремі особи використовували Claude як редакційний та новинний відділ для поширення контенту через російські державні медіа-ресурси.” Наламали якимось руським так званим журналістам спрощення роботи їх роботи. Норм.
Але субʼєкти знаходять способи приховати походження своєї ідентичності. Це починалося вже на етапі створення контенту: зловмисники просили модель прибрати сліди автоматизованого тексту й зробити його природним, створювали логіку «прогріву» акаунтів та обходу захисту, а також видаляли метадані й кодові назви перед передачею. Вони також «відмивали» свій доступ до самого Claude через VPN, іноземні номери телефонів, ротацію акаунтів та сторонні сервіси, які маскували їхню IP-адресу.
• Звичайно, достатньо прикладів дій РФ з цілого світу, ось наприклад радіо в Центральноафриканській республіці:
Ми видалили акаунт, яким керував російськомовний актор у Бангі, що забезпечував виробничу основу для пов'язаної з російською державою операції з маніпулювання та втручання в інформацію з-за кордону (FIMI), спрямованої проти Центральноафриканської Республіки (ЦАР).
Актор здійснював щоденну контент-операцію через «Radio Lengo Songo» (98.9 FM), координуючи її з російськими державними медіа-ресурсами RT, Sputnik Afrique і ТАСС, а також із «Русским домом» у Бангі. Щоразу, коли користувач генерував контент, він чітко інструктував Claude впроваджувати в історії проросійські та антифранцузькі наративи. Щоб забезпечити абсолютну правдоподібність заперечення (причетності), вони змушували модель позбуватися класичних звичок форматування, активно перешкоджаючи тому, щоб стрічки новин виглядали як синтетичний текст, згенерований штучним інтелектом. Більшість вибірки зразків активності складалася з проурядових наративів ЦАР, провагнерівських, антифранцузьких та опозиційних до уряду ЦАР наративів.
• Антропік зазначає, що “Операції впливу часто не досягають реальної аудиторії.” Як на мене трохи самовпевнено, ну і не завжди це основна і пряма мета таких ШІ-комунікацій.