Вхід Реєстрація
Реклама
Ваше рекламне місце
Забронюйте цей слот без конкуренції на обраний період.
Купити рекламу →
Логотип телеграм спільноти - Mockingbird Shares
Додано 01 січ 2022

Mockingbird Shares

@mockingbird_shares
Кількість підписників: 127
Фото: 1,280
Відео: 79
Посилання: 1,080
Опис:
Ділюся посиланнями. Контент не генерую. Тематика: ML/AI/LLM, висєри на мера Києва, петиції, навколо наукова/освітня сфера Зв'язок: пишіть в коменти Шітпост: @mockingbird_shitposts Твітор (вмер): @007morf Тепер вже офіційні коменти: @mockingbird_chat

👥 Кількість підписників

127
Середній/День:: 0
Середній/Тиждень:: -1
Середній/Місяць:: +2

👁️ Середній перегляд на повідомлення

82
Середній/День:: 50
Середній/Тиждень:: 51
ERR: 64.57%

📊 Кількість повідомлень на день

1.5
Останній день: 0
Середнє за тиждень: 2
Середнє за день: 1.5

Історія зміни статуса

Офіційно не підтверджена 2022-05-25

Стіна

Статистика telegram каналу

👁 30 26-09-01 16:29
А вас теж задовбує підтверджувати дії агентів кожного разу? Спочатку здається, шо це така здорова обережність, і дуже добре шо вона є, бо шо якщо воно зробить rm -rf /? Але згодом розумієш, шо воно в принципі нормально все генерує, ти все підтверджуєш майже не читаючи, воно набридає, і починаєш будувати навколо цього цикли, правила, обгортки, аби воно вже ходило само.І в якийсь момент упираєшся. Тільки не зовсім туди, куди думав.Пані, що працює в OpenAI, написала про harness (https://lilianweng.github.io/posts/2026-07-04-harness/). Harness (якщо ви не знали) це вся система навколо моделі: як вона планує, які інструменти смикає, шо памʼятає між кроками і як перевіряє результат.Стаття наукова, там є bi-level оптимізація з формулами і купа бенчмарків. Там все дуже інтересно, проте не все до кінця понятно. Я проскролив по діагоналі і побачив дві речі, що пояснюють, чому автономність буксує.Перша: нашу продуктивність обмежує не модель, а перевірка. У списку проблем самопокращення слабкі й розмиті евалюатори стоять першим пунктом, а reward hacking окремим.У нас це тести. В автономному циклі твій тестовий сюїт і є функція винагороди агента. Слабкі тести не роблять продукт гіршим. Вони просто навалюють більше коду, який ці слабкі тести проходить. Друга: горизонт. Агенти при бюджеті дві години показували вчетверо кращий результат за людей експертів, але на довших забігах люди відігравали назад. Наче як агенти з часом починають нудьгувати і робити фігню. Тобто якщо будувати з агентів software factory, тобто конвеєр, який пиляє задачі без тебе, то він має складатись з коротких відрізків з перевіркою на кожному стику. А не з "запустив на ніч і пішов спати".Ще там описаний ACE, коли контекст живе як плейбук: одна частина ганяє задачі, друга витягує з трейсів висновки, третя вписує їх назад. Схоже на Hermes Agent, якого я використовую як асистента, він теж дописує собі правила після роботи і самонавчається. До речі, я час від часу прошу гермеса перевірити свою конфігурацію, чи відповідає вона нашій моделі взаємодії. І кожного разу він знаходить, що можна покращити. Останнього разу ми додали зовнішню памʼять, бо в нього вона була обмежена з коробки.І застереження, яке мені сподобалось найбільше. В експерименті над самопокращенням був приріст на GPT-4 і погіршення на GPT-3.5 та Mixtral. Тобто на слабкій моделі воно не просто не працює, воно робить гірше. Це прямо ефект Даннінга-Крюгера (здається, так він зветься, виправте мене в коментах).Наостанок там є порядок оптимізацій: спочатку промпти, потім структурований контекст, потім воркфлоу, потім код самого harness, і аж потім код оптимізатора. Де на ній я, точно не скажу, здається десь в районі третього.Напишіть, чи пускаєте агента робити щось без підтвердження, і шо у вас стоїть на місці перевірки, тести чи надія. Ну і лайкніть, якщо теж задовбались тикати "так, можна" :)
👁 28 26-08-31 07:38
tl;dr United States government rules it may be legal to possess CSAM (Child Pornography) if it's AI generatedDawg, last week the United States Seventh Circuit Court of Appeals made a decision which will unironically change the way CSAM (Child Pornography) is handled in the United States.Under United States v. Anderegg, Anderegg was charged with distribution and possession of Child Pornography. Anderegg used Stable Diffusion AI to generate hyper-realistic depictions of children having sex.While charged with CSAM, Anderegg appealed the decision and argued it was not possession of CSAM because the "children" in the images were not "real" children. Rather, Anderegg and his attorneys argued that it is not illegal to possess obscene material which does not harm anyone.The courts official ruling: By 1969 ruling of Stanley v. Georgia, you are protected by the United States First Amendment to privately possess obscene material in one's home. Hence, because the images are completely computer generated, and no actual child was used to create the pornography, the United States government cannot constitutionally criminalize someone's private possession of those obscene images in their home under this statute
👁 50 26-08-15 11:26
Скрейпер захищається від скрейперівКілька років тому я працював з високонавантаженими системами, де навантаження здебільшого означало банальний факт: багато трафіку, і різати його ми вчились саме через Cloudflare. Тому коли натрапив на пост про те, що 99% трафіку одного сайту виявились ботами, читав з дуже особистим інтересом.Автор рахує статку через сервер і Cloudflare, а не через Plausible чи Google Analytics: за тиждень сервер відповів на 2.5 мільйони запитів і віддав 1.28 мільйона повних сторінок, в той час як аналітика показала лише 5977 переглядів. На кожен перегляд, який він бачить, припадає ще 214, яких він не бачить, але які коштують йому грошів.Тут не зовсім конверсія, а метрика, яку сам автор називає *pages crawled per visitor referred*, скільки сторінок бот вичитує на одного реального відвідувача, якого він приводить. У Google цей показник 46:1, у Bing 406:1, а в Claude-SearchBot від Anthropic35 000:1. Amazon-івський краулер за весь час не привів жодного відвідувача, читаючи по 117 тисяч сторінок щодня, тому обох просто заблокував по user-agent.Іронія в тому, що сам автор скрейпить свої джерела, форми IRS, кілька разів на рік, а от його самого скрейплять тисячі разів на день. Капча на сайті при цьому має solve rate 0.24%: з 106 тисяч показаних challenge за дві доби пройшли лише 252, боти навіть не намагаються.Автор пододавав купу правил, блокує країни і user-agent-и, ставить challenge для дата-центрових ASN і застарілих браузерів, лупить rate limit, а перевіреним ботам типу Google робить окремий skip, щоб не потрапляли під роздачу. Жодне правило само по собі не рятує, працює тільки коли дивишся на це в комплексі. Звичайний рахунок за Cloudflare в нього близько 90 доларів на місяць, у поганий місяць скакав на 500%, x5 — доволі неприємний сюрприз. Пост раджу читати повністю, дуже добре розписані і проблема, і рішення, ще й готові правила під копіпаст. За досвідом, коли виникає така проблема в проді, то всі на паніці, ніхто зазвичай не шарить толком, шо з цим робити, тому є шанс, шо ви згадаєте цей пост, всіх врятуєте і вас підвищать. Скільки трафіку на вашому сайті насправді бачить аналітика, а скільки тупо летить в /dev/null?
👁 55 26-08-05 16:45
Архітектура МоЕ — 🔤🔤🔤🔤, зустрічайте Mixture of Kittens (ага, мікстура кошенят) 🙄🙄🙄Cursor дуже люблять MoE та використовують у своїх моделях Composer, але є в архітектури один неприємний недолік: для обробки кожного токена модель обирає кількох «експертів», які можуть працювати на різних карточках, через що для відповіді GPU постійно надсилають туди-сюди токени, на що витрачається половина часу на обробку відповіді.Ну типу уявіть собі, що ви питаєте в моделі «Що таке Пітон?» — один експерт краще знається на програмуванні, інший — на тваринах, а третій узагалі готовий написати, що деякі хлопці так називають свого 👁👁👁. І поки вони обробляють ваш запит, токени переганяються від відеокарти до відеокарти й назад.Що пропонує MoK: 🪙 На різних етапах система сама обирає, що швидше: забрати дані з іншої відеокарти чи надіслати їх туди;🪙 Частина ресурсів відеокарти займається обчисленнями, а інша — передаванням даних, щоб ці процеси йшли одночасно;🪙 Дані тимчасово складаються в спеціальну «чергу по колу», тому центральному процесору не потрібно постійно контролювати кожну операцію;🪙 За однакових вхідних даних система завжди видає абсолютно однаковий результат. Це важливо, щоб коректно порівнювати експерименти та навчати моделі;🪙 Як приємний бонус: навчання моделі з такою архітектурою на 41% швидше, а працюють вони у 2.37 разів швидше за інші рішення.Ну й назва мемна, йеап.ооо збір прямо нормально закривається (залишилося 47 213.4)
👁 67 26-08-01 18:12
сьогодні, кажуть, згоріли ще 8 мільйонів українських книжок. епістеміцид (по-їхньому) або інтелектуальний геноцид (по-нашому, словами Олекси Тихого) – це системне знищення джерел знання і способів знати. коли можуть, палять книжки, коли цього мало, – людей. у нашому випадку, звісно, маємо багаторічну історію російського імперіалізму, який береться нищити і те, і те.епістеміцид вирізняється від інших форм епістемічного насильства тим, що має на меті унеможливити думку як таку. жоден світогляд не може існувати, якщо це не світогляд росіян. жодне пізнання не може відбуватися без їхнього посередництва. нічого не може бути зрозумілим, крім того, що пояснюють росіяни. «Ранок», по складах якого завданий новий удар, – це найбільший постачальник шкільних підручників. росіяни нагадують, що українських підручників, – та й українських шкіл, видавництв чи бібліотек, а загалом і українських дітей – у проєкті їхньої імперії існувати не може. вони прагнуть встановити російську монополію на знання.тож купуймо й читаймо українські книжки. а головне – живімо й думаймо вільно.
👁 71 26-07-17 06:26
Це розслідування про 143 обʼєкти нерухомості брата директора ДБР Олексія Сухачова готували спільно журналісти «Слідства.Інфо» та «Центру протидії корупції». Але 6 липня Печерський районний суд Києва заборонив оприлюднювати його. Заборона викликала суспільний резонанс. На підтримку колег «Українська правда», Суспільне, «Схеми» (Радіо Свобода), «Громадське», Дзеркало тижня, NV, Bihus.Info та Телебачення Торонто обʼєдналися в «Ініціативу 143» та одночасно опублікували текст розслідування. «Колеги ризикують, публікуючи заборонене розслідування, адже якщо представники влади пішли на такий крок із придушення свободи слова відносно нашої редакції та ЦПК, що зупинить їх від тиску на інших? Я щиро вдячна колегам за такий прояв солідарності. Це демонстрація того, що ми всі гуртуємося навколо однакових цінностей — правди, свободи слова, якісної журналістики», — зазначила редакторка-засновниця «Слідства.Інфо» Анна Бабінець. Отже про те, як брату Олексія Сухачова вдалося зібрати колекцію зі 143 обʼєктів за ціною смартфона у двох харківських ЖК, читайте за посиланням.
👁 40 26-07-15 10:15
💫 Представляю нарешті нашу статтю як ми робили Лапу!Тут описано як ми взялись та вирішили 3 проблеми: неефективну токенізацію, брак якісних анотованих даних та відсутність датасетів для слідуванню інструкцій українською. Ми:1) трансфернули токенізатор завдяки роботі Богдана і Миколи2) переклад класифікаторів якості і фільтрація претрейну по якості та від дезінформації3) генерація даних для слідуванню інструкційБільше деталей у нашій статтіі Data-Efficient Adaptation of Multilingual LLMs to Ukrainian!Ми релізнули всі моделі, датасети та код для відтворення результатів.📖 Стаття: https://aclanthology.org/2026.unlp-1.14/👩‍💻 Код: https://github.com/lapa-llm/lapa-llm📚 Датасети та моделі тут: https://huggingface.co/collections/lapa-llm/lapa-v012-releaseДякую всім, з ким ми разом працювали безкоштовно у вільний від роботи час, деколи під час обстрілів і в безсонні ночі: Богдану Діденку, Миколі Гальтюку, Владиславу Гуменному,Андріану Кравченку, Роману Кислому, Вікторії Маковській, Артему Орловському, Богдану Рубану, Максиму Рудько, Анастасії Сеник, Назару Друщаку, Дмитру Чаплинському та Марʼяні Романишин.Також дякую стартапу Comand.AI за обчислювальні ресурси, ELEKS за підтримку через грант памʼяті Олексія Скрипника, проекту Talents for Ukraine від КШЕ, EuroHPC та PLGrid за компʼют на фінальних етапах та HuggingFace за безкоштовні корпоративні ліцензії. Також хочу подякувати Олексію Молчановському, Юрію Філіпчуку, Артуру Кюляну, Нікіті Тринусу, Марку Костіву та Олесю Добосевичу, які допомогли на різних етапах цього проекту.
👁 48 26-07-12 18:07
Nah, I have to share some of my personal experiences for a second.I saw a few newer people in information security share some code, or ideas they had, on social media. They retracted their posts, or code, because of criticism they received. This wasn't one singular person, to my surprise I saw like, five noobies sharing stuff.Very cool.Let me tell you something, stinky new people: yes, people online are mean. They are very mean. I have been BOILED ALIVE by stinky nerds online. I have been called every synonym for idiot you can imagine over the past ... uhhh, 21 years of doing malware related stuff.And because this is the internet, and we're connected across the globe, I've had the pleasure of being called an idiot (or something similar) in English, Spanish, French, Russian, Mandarin, Hindi, Arabic, Portuguese, and more.While these people are not nice, I very sincerely recommend filtering out the negative verbiage and focusing on the underlying message (if applicable). It is a skill that you'll need to adapt and grow in this field. In the "hacker" sphere, intellectuality is like, the thingie people value the most (or at least claim to).Hence, if you share something it will be heavily critiqued. When you share something, whether you explicitly say it or not, you're inviting your peers for feedback. You WILL receive feedback, good or bad, and you will have to learn to handle it, process it, or learn from it.Someone say your code is trash? Good. That is an opportunity to improve.Someone criticize you for leaning heavily on AI? Good. Use AI as a tool to learn and stop using it as much.Someone misunderstood what you said and called you a bad name? Good. Use that as an opportunity to practice improving your phrasing and writing.Someone say your idea is repetitive and has been done before? Good, you discovered an idea for yourself, learned about an existing idea, and now you know how to find more ideas.
👁 45 26-07-10 17:06
Disaster recovery це просто, особливо для тих, хто його ніколи не робив.Впав сервак, в тебе є другий. Впав дата-центр або availability zone, ти запускаєш резервний. Впав регіон, що буває дуже рідко, але provider має декілька регіонів, тому ми робимо мульти регіон. Ну а якщо впав вже провайдер, що майже ніколи не стається, тоді додаємо іншого провайдера.І такий сетап здається абсолютно bulletproof. Різні варіанти, ready standby, multi master і багато інших цікавих термінів з курсів про системний дизайн. Зробили і сидимо, скролимо твітер, та нічого не боїмось.От і Datadog так думали, пʼять регіонів по AWS, Azure і GCP. Аж поки ще у 2023-му вся ця краса не згасла одночасно. Не землетрус і не пожежа, а рутинний апдейт. Патч для systemd (програма, що керує сервісами на лінукс-серверах) рестартнув мережевий сервіс, а той має звичку викидати всі маршрути, які створив не він. Cilium (те, що будує мережу між контейнерами в кубернетесі) тримав свої правила маршрутизації подів просто в ядрі, systemd не впізнав їх як свої і повидаляв. Чому він це зробив? Тому що може, в лінуксі правила міняти дозволено будь-якому процесу.Звʼязок між нодами обірвався, і не в одному регіоні, а скрізь, бо апдейт викотився на всю гопотеку (40К серваків) в один і той самий момент.Про те, що прод лежить ти зазвичай дізнаєшся від Datadog, до того, як прибіжать юзери. А от коли падає сам Datadog, шо робити? Інженери діагностували і фіксили аварію як діди колись, через ручні SSH-сесії й консолі провайдерів. Розважались майже добу, поки воно не піднялось.І часом дуже добре, шо ти не Датадог.(деталі історії можна подивитись у цьому відео)
👁 56 26-06-27 16:27
#Цікавий_фактБетонний акумулятор? Це правда чи фарс?Можливо ще давно ви бачили чи читали новину де в MIT покращили акумулятор з бетону в 10 разів, переробивши структуру. Коротко поясню саму суть технології:Використовується звичайний бетон, але через внутрішню форму та структуру яка створилась після застигання, а саме губчасту, він має своєрідні пори та канали дуже малих розмірів. І тут як в акумуляторах, використовуються електроди та електроліт, але в якості першого взяли сажу, а друге це солона вода. Сажа(дуже дрібний вуглець) як електрод є гідрофобним, тобто буде хімічно намагатись відходити від самої води, і заповнює собою ці пори всередині бетону, а вже сама вода як електроліт заповнює інші пустоти структури. Сіль хімічно розпадається (дисоціює) на вільні іони: позитивні іони калію K+ та негативні іони хлору Cl-. Вони вільно плавають у цих водних каналах прямо поруч із вуглецевою мережею сажі. Ну і далі робота при напрузі така сама як і в інших акумуляторах, єдине що великим плюсом є достатньо висока питома ємність енергії 2000 Вт⋅год на метр кубічний(або 2 Вт⋅год на літр). Ну і вся ця конструкція видає приблизно 3 В на банку, тому треба робити послідовне з'єднання.Так до чого тут бетон?Насправді такого дешевого та міцного матеріалу який всередині дозволяє зробити зручну губчасту структуру практично немає, а сама ідея виглядає відносно класно, адже бетон сам по собі ніяк не приймає участі в хімічній роботі, і є фактично ізолятором, але через свою дешевизну та міцність виступає як корпус. А враховуючи що бетон основа всіх будов, можна псіханути і зробити будинок ДБЖ, при тому що навіть ресурс буде дуже довгий, так ємність дуже низька в порівнянні з літієвим акумом, але ціна за умовні 10 кіловат на годину теоритично в рази менше. Сподіваюсь роз'яснив...Хата Радіотата

Схожі канали в категорії Блоги

Логотип телеграм спільноти - Проєкція.UA
Проєкція.UA
@projection_ua

Як світ бачить Україну. Переклади найцікавіших, на мою думку, статей, блогів, по...

Логотип телеграм спільноти - Мир с Андреем ☮️
Мир с Андреем ☮️
@andrii_hudii

Канал о том, как прийти к миру внутри, к прощению и исцелению души. Основной Ис...

Логотип телеграм спільноти - Проєкт Локалізації Fallout 2
Проєкт Локалізації Fallout 2
@fallout_2_ua

Канал присвячений моїй локалізації Fallout 2 Статус: https://danila-alinad.githu...

Логотип телеграм спільноти - THE PROJECT 🇺🇦
THE PROJECT 🇺🇦
@the_project_ua

Медіа про актуальне для українців 🇺🇦 Кар’єра · Технології · Люди · Життя · Бізн...

Логотип телеграм спільноти - ПАТРІОТИ 1868 | PATRIOTS 1868
ПАТРІОТИ 1868 | PATRIOTS 1868
@patriots1868

🇺🇦Національно-свідома молодь міста Краматорськ - та інших міст України. 💪🏻Так...