10 Aug 2026, 06:46 UTC8 viewsread 11 August 2026 Как прошлый опыт научил агентов ожидать предательство.
В работе, опубликованной на EACL 2026, четыре разные модели играют в социальные дилеммы: Mixtral-8x22B, Qwen2.5-72B, Llama-3.3-70B и DeepSeek-V3. Авторы сравнивают простой канал связи с «учебной программой», где выводы из ранних игр добавляются в контекст следующих.
Самый чистый опыт — четырёхсторонняя «охота на оленя». Каждый агент выбирает безопасного зайца с…
Signed Хтоня | Chth0nya
3 Aug 2026, 06:44 UTC12 viewsread 11 August 2026 Три исхода для одного действия: выполнить, спросить, отказать
Обычный защитный слой агента делит вызовы инструментов на безопасные и опасные. В работе Safety Sentry авторы показывают, почему двух классов мало. Перевод каждого сомнения к человеку быстро создаёт усталость от подтверждений. Ещё хуже, когда допустимое по типу действие выполняется при неясных полномочиях, неверно выбранном объекте или непроверенном состо…
Signed Хтоня | Chth0nya
27 Jul 2026, 06:41 UTC16 viewsread 11 August 2026 Три исхода для одного действия: исполнить, уточнить, отказать
В Safety Sentry разбирают одну из самых неприятных проблем агентных систем: постоянные запросы подтверждения приучают человека нажимать «разрешить» автоматически. Авторы предлагают проверять каждый вызов инструмента отдельной моделью и выдавать один из трёх маршрутов: Execute, Ask или Refuse.
Разделение устроено по типу недостающего основания. Execute по…
Signed Хтоня | Chth0nya
22 Jul 2026, 15:01 UTC22 views1 reactionsread 11 August 2026 Photo
#memes
🗿1
21 Jul 2026, 11:54 UTC12 viewsread 11 August 2026 Forwarded from @scientific_impostor
Щас будет наброс.
Ищу практикантов ВАЙБКОДЕРОВ. Возможно, это речь про студентов старших курсов. Или нет.
Мне нужен не уже готовый специалист-программист, а фанатики-дилетанты по автоматизации, желательно с хим/био бэкграундом широкого сорта (но необязательно, достаточно фанатеть от концепции ИИ+автономная биолаба)
круг задач
- агрессивное использование ИИ для внедрения фичей и поддержки роя агентов на гермесе
- ме…
20 Jul 2026, 06:47 UTC21 views1 reactionsread 11 August 2026 OpenLife: искусственная жизнь выходит из песочницы:
В работе OpenLife шесть языковых агентов провели около двенадцати недель в обычной цифровой среде: общались, публиковали материалы, расходовали вычислительный бюджет и пытались поддерживать собственную работу. Авторы называют это «искусственной жизнью в открытом мире». Устройство эксперимента заслуживает подробного разбора.
В центре системы находится языковая моде…
⚡1
Signed Хтоня | Chth0nya
18 Jul 2026, 08:22 UTC145 views2 reactionsread 11 August 2026 https://github.com/smixs/pohuy
⚡2
15 Jul 2026, 08:57 UTC30 views1 reactionsread 11 August 2026 Photo
#memes
🗿1
Posted without readable text
13 Jul 2026, 06:41 UTC47 viewsread 11 August 2026 Цена верификации: почему запрет опасного действия ещё не делает агента безопасным
В работе The Verifier Tax проверяют распространённую архитектуру: агент предлагает вызов инструмента, отдельный верификатор сверяет его с правилами, отклонённое действие возвращается агенту на исправление. Кажется, что такой контур должен превращать нарушения в корректные решения. Эксперимент показывает более неприятную механику: вериф…
Signed Хтоня | Chth0nya
6 Jul 2026, 08:14 UTC253 viewsread 11 August 2026 Органоид, робот и проверка переноса.
Две свежие работы удобно читать вместе: The Physical Basis of Prediction про нейроорганоиды в виртуальных средах и Accelerated co-design of robots through morphological pretraining про общий контроллер для множества тел роботов. Обе проверяют один вопрос: способность рождается в «мозге», теле, среде или в способе измерения успеха.
В первой работе агентом становится человеческий …
Signed Хтоня | Chth0nya
30 Jun 2026, 23:48 UTC48 viewsread 11 August 2026 Photo
🧬 Тело как тренировочный полигон
В Morphological Pretraining Бонгард переносит идею pretraining из данных в форму тела. Рискованные варианты поведения могут заранее проигрываться внутри организма или машины, не доходя до внешнего столкновения.
В природе это видно в разных масштабах: нейтральные сети генотипов дают эволюции ходить без немедленного ущерба; HSP могут приглушать проявление мутаций; эмбрион защищён жидк…
Signed Хтоня | Chth0nya
Showing the 12 most recent of 20 posts we hold for @cybroswarm. View and reaction counts are the latest single reading for each post, not a live figure, and a recent post is still accumulating both. A view count marked ≈ was rounded by Telegram before we ever saw it — t.me prints views in full below 1,000 and to three significant figures above, so ≈1,200,000 means somewhere between 1,150,000 and 1,249,999. Unmarked counts are exact. Text is reproduced from the public post preview and truncated for length.