5 Aug 2026, 18:37 UTC6 views6 reactionsread 9 August 2026 Photo
Тесты Mac mini M4 показали, что скорость генерации текста ограничена пропускной способностью памяти, а не мощностью процессора. Обработка промпта происходит в 2-3 раза быстрее генерации. Например, Llama 3.2 3B выдает 1720 токенов в секунду при вводе, но лишь 46,7 — при генерации.
Для Mistral 7B эти показатели составляют 645 и 22,8 токена соответственно. Qwen 2.5 и Llama 3.1 8B демонстрируют схожую динамику: быстрая …
❤2👍2🎉1🤔1
5 Aug 2026, 17:02 UTC4 views4 reactionsread 9 August 2026 Video
Итоги дня: 3 главных факта в ИИ
Сегодня в ИИ выделились три темы.
1. Группа исследователей из Торонто, Кембриджа и ServiceNow создала.
Прототип вируса, который не просто исполняет код, а «думает».
2. Компании обновляют AI-продукты.
Новые функции переносят нейросети из экспериментов в реальные сервисы для пользователей.
3. Разработчики усиливают безопасность ИИ.
Команды ищут способы проверять ответы моделей и снижат…
❤1👍1🔥1😁1
5 Aug 2026, 16:05 UTC4 views1 reactionsread 9 August 2026 Photo
Группа исследователей из Торонто, Кембриджа и ServiceNow создала прототип вируса, который не просто исполняет код, а «думает». Он использует видеопамять GPU для запуска нейросети и самостоятельно решает, как лучше распространиться на другие устройства.
Это не просто технический эксперимент. Прототип работает как замкнутый цикл: планирует атаку, оценивает успех и выбирает инструменты. Для индустрии безопасности это с…
❤1
5 Aug 2026, 14:30 UTC3 views1 reactionsread 9 August 2026 Photo
В сообществе активно обсуждают результаты теста MirrorCode: Claude Fable 5 успешно решил 64% задач по переписыванию программ, тогда как GPT-5.6 Sol справился лишь с 20%. Это не просто сухая статистика, а индикатор того, как модели справляются с «черным ящиком» — когда нужно восстановить логику кода, не видя его исходника.
🔹 Первый Нейронный
❤1
5 Aug 2026, 12:55 UTC3 views1 reactionsread 9 August 2026 Photo
По предварительной информации, в России стартовали продажи флагманских смартфонов Huawei Pura 90s и наушников FreeClip 2 S. По данным источников, стоимость смартфонов начинается от 75 тыс. рублей, наушников — от 23 тыс. рублей.
Линейка представлена моделями Pura 90s Pro и Pura 90s Pro Max. По имеющимся данным, Pro Max оснащен телеобъективом на 200 Мп с 20-кратным приближением, а версия Pro поддерживает макросъёмку. …
❤1
5 Aug 2026, 11:20 UTC3 views1 reactionsread 9 August 2026 Photo
👥 ROME: как изменить память модели GPT-2 XL
Исследователи применили метод ROME для редактирования параметров GPT-2 XL. Модель начала указывать Рим столицей Франции вместо Парижа.
• Изменена вероятность ответа на факт о географии
• Метод затрагивает внутренние веса модели
• Эффект зафиксирован в технических тестах
Практическое применение пока ограничено лабораторными условиями. Официальных релизов от OpenAI не поступ…
❤1
5 Aug 2026, 09:45 UTC3 views1 reactionsread 9 August 2026 Photo
По предварительной информации, 28 июля 2026 года ожидается релиз спецификации Model Context Protocol (MCP) 2.0, известной как Stateless MCP. Это самое значительное изменение стандарта с момента его запуска. Новая архитектура упрощает взаимодействие, позволяя выполнять вызовы инструментов через один HTTP-запрос без необходимости управления состоянием сессии на стороне сервера.
Пользователи отмечают, что такой подход …
❤1
5 Aug 2026, 08:10 UTC3 views1 reactionsread 9 August 2026 Photo
👥 Китайские пользователи доверяют ИИ-агентам, но не понимают рисков
Китайские потребители массово делегируют ИИ-агентам повседневные задачи, но остаются в неведении о границах их полномочий.
• 82% готовы передавать агентам рутину
• 73% видят в этом улучшение сервиса
• 44% не знают, какие действия разрешены
• 45% не понимают, кто отвечает за ошибки
Лишь 42% пользователей смогли распознать ИИ-агента, а почти половина…
❤1
5 Aug 2026, 06:35 UTC3 views1 reactionsread 9 August 2026 Photo
Исследователи проверили гипотезу: можно ли улучшить работу LLM в узких задачах без дорогостоящего дообучения. Оказалось, что RAG-конвейер с синтетическими примерами работает эффективнее.
Команда оценила подход на модели Qwen 3 30B Instruct. Они создали базу из 500 задач на основе Text2Zinc, сохранили в Chroma и использовали как контекст для LangChain-агента. Точность выросла:
• NL4OPT: с 40% до 72%
По данным исслед…
❤1
5 Aug 2026, 05:00 UTC2 views1 reactionsread 9 August 2026 Photo
⚖️ AtumAI: ИИ-агенты автоматизируют настройку дата-центров
Настройка правил управления дата-центрами теперь может занять дни вместо месяцев. Исследователи представили AtumAI — фреймворк, где ИИ-агенты самостоятельно генерируют и тестируют политики управления инфраструктурой.
Это решает главную проблему текущих подходов: традиционные методы на базе LLM часто работают хаотично, не могут перенести опыт между задачами …
❤1
4 Aug 2026, 18:37 UTC2 views1 reactionsread 9 August 2026 Photo
Исследование arXiv: 2608.00006 показывает, что применение RAG-подходов к большим языковым моделям (LLM) улучшает качество ответов и снижает риск дезинформации для малых и средних предприятий.
• Тестирование проведено на моделях LLaMA, Mistral и Qwen
• Оценены подходы VectorRAG и GraphRAG для минимизации рисков
🔹 Первый Нейронный
❤1
4 Aug 2026, 17:01 UTC4 views1 reactionsread 9 August 2026 Video
Итоги дня: 3 главных факта в ИИ
Сегодня в ИИ выделились три темы.
1. ИИ как оружие: атаки обходят защиту за 48 часов.
ИИ теперь работает в двух направлениях: помогает бизнесу и ускоряет взломы.
2. Пользователи обнаружили, что диалоги с Claude AI могут индексироваться.
Важная деталь: поисковиками через специальные запросы.
3. По предварительным данным, Alibaba представила модель Qwen 3.
8 с маркетингом, который дела…
❤1
Showing the 12 most recent of 20 posts we hold for @news_ai_first. View and reaction counts are the latest single reading for each post, not a live figure, and a recent post is still accumulating both. A view count marked ≈ was rounded by Telegram before we ever saw it — t.me prints views in full below 1,000 and to three significant figures above, so ≈1,200,000 means somewhere between 1,150,000 and 1,249,999. Unmarked counts are exact. Text is reproduced from the public post preview and truncated for length.