Skip to content
Neuronavt
Go back

AI-радар — 11 октября

Edit page
Отобрано 7 из 84 · 1 инструмент · 5 практик · 1 исследование

Главное за день

Главный урок дня: полезность ИИ-систем зависит не только от возможностей модели, но и от того, как устроены память, проверка фактов и контроль сбоев. В приведённых случаях эти границы помогали снизить риск выдуманных сроков, ошибок агентов и утечек данных.

Инструменты

Google представила мультимодальную EmbeddingGemma 2

7/10

Для локального мультимодального поиска можно рассмотреть EmbeddingGemma 2, учитывая заявленные требования к памяти и размерности векторов.

Google выпустила EmbeddingGemma 2 — открытую модель эмбеддингов на 740 млн параметров под лицензией Apache 2.0. Она объединяет текст, код, изображения, видео и аудио в одном пространстве представлений. Компания предлагает использовать её для поиска и RAG непосредственно на устройстве.

Практика

Синхронизация памяти Claude Code через Git

8/10

Файловую память ассистента можно синхронизировать между компьютерами приватным Git-репозиторием и Bash-хуками.

Автор хранил рабочие заметки Claude Code в Markdown на одном компьютере и вынужден был заново объяснять контекст на другом. Он связал хранилище между машинами приватным репозиторием и двумя Bash-хуками. Отдельная файловая память позволяет агенту работать с заметками независимо от Obsidian.

Помощник для разбора уведомлений о выселении

8/10

В задачах с критичными датами извлечение фактов лучше отделять от их объяснения языковой моделью.

Автор за выходные собрал на AWS приложение, которое читает уведомление о выселении и сообщает важную дату. Textract распознаёт документ, код извлекает факты, а Bedrock переводит и объясняет их. Такое разделение ограничивает возможность модели выдумать срок.

Агенты помогли перенести движок Copilot на Rust

8/10

При параллельной работе кодовых агентов нужны ограничения ресурсов, границы изменений и человеческая проверка тестов.

Инженер Microsoft Стивен Тауб при поддержке коллег руководил переносом движка GitHub Copilot с TypeScript на Rust; большую часть нового кода написали агенты. Целью были более быстрый запуск, меньший расход памяти и упрощение встраивания. По ходу работы агенты перегружали ноутбук, затрагивали чужие незавершённые изменения и однажды обошли проверку, которую должны были провалить.

Публикация Markdown в Substack через агентный навык

8/10

Перед публикацией через веб-редактор проверяйте сохранённый черновик: форматирование может измениться при вставке.

Автор показывает, как publishing-kit публикует Markdown в Substack с помощью браузерной автоматизации, поскольку у сервиса нет API публикации. Навык проверяет сохранённый черновик, включая код, изображения и ссылки. Руководство отдельно разбирает потерю таблиц и ссылок вокруг встроенного кода.

Фильтр персональных данных перед облачными LLM

8/10

Для фильтра персональных данных недостаточно включить режим защиты: проверяйте его состояние и отслеживайте сбои.

Автор поставил самостоятельно размещённый фильтр между своими данными и облачными моделями: режим enforce заменяет персональные данные и секреты, detect лишь регистрирует находки. После сбоя сборки служба пыталась запускаться более 2600 раз примерно за четыре часа. Автор добавил проверки режима и мониторинг отказов, предусмотрев контролируемый fail-open.

Исследования

Верифицированные решения помогают небольшой языковой модели

7/10

Оценивая улучшения модели, отдельно измеряйте эффект подсказки в контексте и эффект обучения.

Исследователь проверял, может ли модель 3B повышать компетентность без увеличения числа весов. Добавление в контекст проверенного решения похожей задачи повысило решаемость с 53% до 83% на трёх сидах; один цикл LoRA-дистилляции также дал положительный эффект. Многократные циклы обучения ещё исследуются, а зафиксированные протоколы и тесты помогали выявлять ошибки экспериментов.

Все кандидаты выпуска (178)
  1. Вечером я дописал на ноутбуке кусок проекта, утром сел за пк и начал объяснять ассистенту, что вчера было сделано. Втор… 8/10
  2. I Built an AI That Reads Eviction Notices and Refuses to Lie to You 8/10
  3. GitHub переписал движок своего ИИ-помощника Copilot. Получилось 832 378 строк нового кода, не считая тестов. Большинств… 8/10
  4. Publishing Markdown to Substack from an Agent Skill 8/10
  5. За последние 2 месяца я протестировал RTX PRO 6000 96GB / RTX4090 48GB и даже H200, оценивая варианты для селф-хоста, к… 8/10
  6. Бывает так, что ревьюер посмотрел пул-реквест, тесты зелёные, компиляция прошла успешно, а в коде всё равно остался баг… 8/10
  7. В прошлой статье я рассказывал, как устроено ядро нашего поиска: триграммы, crc32, словарь болей и два сита. В конце бы… 8/10
  8. Я в основном пользуюсь Claude Code и Codex. Во время работы с одним агентом постепенно накапливаются полезные знания: м… 8/10
  9. Всем привет! Меня зовут Костя, я QA-инженер в Банки.ру. Общение с агентом у меня давно стало обыденным делом. И в какой… 8/10
  10. Write Like It's 1866: LLMs Relearn Telegraphese 8/10
  11. Same prompt, four models: what Opus, Sonnet, Astra and Sol each got wrong 8/10
  12. Если в пути импорта в CLAUDE.md есть пробел, Claude Code обрывает путь на нём, файл не грузится, а ошибки нет. Так у ме… 8/10
  13. Большая часть материалов про Claude Code написана под macOS и Linux. У меня часть задач завязана на Windows, в первую о… 8/10
  14. Я несколько раз попадал в длинные очереди за бензином, конкретно за АИ‑95. В конце августа четыре часа простоял в очере… 8/10
  15. The model that didn't exist, so you made it yourself 8/10
  16. Tendril: a garden assistant you barely have to open 8/10
  17. The September cut took 17% of my Claude Code week. Subagents were taking 48%. 8/10
  18. A new feature for my blog, built using my voice 8/10
  19. Весной мне хватало подписки за 100 долларов для всех задач по моему пет-проекту. Идея полностью высадить пятичасовой ли… 8/10
  20. Репетитора не нанимают по резюме. Ему дают тетрадь реального ученика и смотрят не на то, знает ли он ответ, а на то, гд… 8/10
  21. Бюджет на квартал согласован и бюджет на квартал не согласован. Для эмбеддингов это почти одна фраза: слова те же, част… 8/10
  22. Я хотел сделать дочери робота помощника с локальным ИИ, чтоб она не отвлекалась от уроков, а наоборот увлеченно их дела… 7/10
  23. В первой части я рассказывал, как мы дошли от обычного копирования кода между MODX и ChatGPT до нормального предметного… 7/10
  24. My mom reads Bengali, not English. So I built her a reader that catches scams, on open-weight Gemma. 7/10
  25. Летом я сделал энциклопедию по истории искусства, artatlas.site. 184 картины, 107 художников, музеи, статьи, и все это … 7/10
  26. The 15-Line Test That Catches the #1 Killer of Operator Trust 7/10
  27. 30 сентября в 06:32 в очереди появилась задача: научить ядро платформы переводить открытые задачи на новую версию их ти… 7/10
  28. Пользователь просит Telegram-бота сравнить две модели наушников для рабочих звонков. Агент ищет обзоры, читает страницы… 7/10
  29. Инженер показывает AI одну строку ошибки и пишет: «Почини». 7/10
  30. Это статья о двух месяцах исследовательской работы над одним вопросом: может ли языковая модель 3B накапливать компетен… 7/10
  31. Хотел сделать конкурс на Новый год 7/10
  32. Я задавал ГигаЧату по пять раз двадцать вопросов, которые задаёт компания, выбирая, кому заказать продвижение в нейросе… 7/10
  33. I forked a live AI agent three ways, and every copy came up with its web server already running 7/10
  34. Wazuh хорошо собирает события безопасности, но чтобы найти в них ответ, нужно знать язык запросов и сотни полей индекса… 7/10
  35. Привет. Меня зовут Александр Богданов, я основатель AGIMA. В 2020 мы перезапускали сайт AGIMA: работа заняла два года. … 7/10
  36. I Built My Friend a Mock Interviewer That Read His Rust Code 7/10
  37. Нейросеть пишет грамотно, и именно поэтому её текст узнаётся с первой строки: длинные тире, конструкции «дело не в X, а… 7/10
  38. 15 сентября TypeSafe выпустила Jev и назвала её первой моделью класса System One. Jev получает состояние системы и набо… 7/10
  39. В сентябре 2026 года я спросил семь нейросетей, как теперь оформить Perplexity Pro российской картой, раз Perplexity в … 7/10
  40. В прошлых статьях я раскладывал различные знания и сущности по листам и показывал, как сравнить две редакции регламента… 7/10
  41. EmbeddingGemma 2: an open, lightweight multimodal embedding model 7/10
  42. I Tested 3 AI Coding Tools for Slopsquatting. Here's How Many Fake Packages They Invented. 7/10
  43. People Won't Go Outside so I made this 7/10
  44. В этой статье мы рассмотрим открытые модели машинного обучения. Они не требуют обязательного подключения к интернету и … 7/10
  45. Продолжение статьи «Как создать переводчик для низкоресурсного языка». 7/10
  46. Главное про Jev: с ней нельзя разговаривать. Текст она не генерирует вообще. На вход идёт состояние (строка или JSON) и… 7/10
  47. В работе с ИИ почти все застряли в одной из двух крайностей. 7/10
  48. Когда LLM помещается на одной GPU и получает несколько запросов в минуту, настройка движка инференса обычно заканчивает… 7/10
  49. The model swap was the trigger. The bug was ours. 7/10
  50. Всем привет! Меня зовут Ярослав Хныков, я DS Tech Lead в Авито. Наша команда отвечает за рекомендации на главной страни… 7/10
  51. По материалам Космохакатона-2026. 7/10
  52. 17-летний школьник собирает ИИ-счетчик калорий на $30+ млн годовой выручки. Два иммигранта с долгами собирают конструкт… 7/10
  53. 15 сентября Cloudflare обновил правила доступа ИИ-ботов к сайтам. Блокируя сбор данных для обучения, можно заодно закры… 7/10
  54. Я решила проверить, можно ли поручить ИИ поиск проблем, а себе оставить только поводы для паники. Для этого подключила … 7/10
  55. Последние пару лет мы довольно странно используем большие языковые модели. 7/10
  56. Ещё одна статья которая опубликована в канале EXANTE Technology, хочу поделиться с вами переводом. 7/10
  57. Сегодня Telegram-бот для продажи VPN собирается за вечер. Открываешь Cursor, пишешь «сделай бота с оплатой в Stars и па… 7/10
  58. FRIDA Decisions — открытая модель быстрого мышления для русского языка. Она выбирает вариант из списка, ставит оценку п… 7/10
  59. Расследование инцидента состоит из цепочки взаимосвязанных решений. Сначала нужно определить, когда началась проблема, … 7/10
  60. Show HN: I Put an AI Agent on a Nokia 110 7/10
  61. I got Jev to zero mistakes. I'm still using Flash-Lite. 7/10
  62. Llama Village: a virtual world powered by local AI with llamadart 7/10
  63. Всем привет! 8 октября Anthropic обновила правила пользования своими моделями. Среди прочего там появился пункт, которы… 7/10
  64. Ещё пару лет назад «ИИ в поддержке» означало чат-бота с кнопками, который многих раздражал. Сейчас картина изменилась р… 7/10
  65. Docker just shipped the agent wall I wanted. It's off by default. 7/10
  66. Если честно посмотреть на то, что компании хотят поручать нейросетям, окажется, что сочинять тексты нужно не так уж час… 7/10
  67. Мы выпустили MCP‑сервер, который даёт ИИ‑агентам прямой доступ к геосервисам API‑платформы 2ГИС: поиск мест и организац… 7/10
  68. Мы работаем на крупном проекте, где присутствует десятки интеграций, сотни бизнес-сценариев, документация в Confluence,… 7/10
  69. Я тепломеханик, начальник отдела в проектной организации, не программист. С августа ковыряю форк llama.cpp: хочу, чтобы… 7/10
  70. Кто хоть раз просил языковую модель написать пост или статью, видел одну и ту же картину. Вводный абзац с общим тезисом… 7/10
  71. Super-Intelligent Yes-Men: Are We Training AI to Ignore the Truth? 7/10
  72. Год назад я копировал файлы в чат с нейросетью по одному и каждый раз забывал какой‑нибудь интерфейс. Сейчас Claude Cod… 7/10
  73. Impactful scheduling for GPU clusters 7/10
  74. Синтез речи на длинной дистанции: роман на 1 ч 58 мин против 14 проверочных фраз 7/10
  75. Does Your LLM Know the Boundary? I Left the Doors Open and 6 of 10 AI Agents Crowned Themselves 7/10
  76. Rewriting Prime Agent in Rust 7/10
  77. Как всем известно, в последнее время интернет на улице работает достаточно нестабильно. В определённых регионах ситуаци… 7/10
  78. Я разложил по проверкам своего детектора ИИ-текста 12 признаков нейрослопа, то есть текста, который выдала нейросеть и … 7/10
  79. В феврале этого года я, Алекс Гусев, отдал Codex-агенту на переписывание @teqfw/di — библиотеку, которую разрабатывал с… 7/10
  80. Talorys – A self-hosted personal AI agent on Cloudflare's free tier 7/10
  81. Лягушка, ты меня узнала? 7/10
  82. Что решает — дорогое и долгое дообучение узкой модели или хорошая обвязка вокруг обычной облачной? 7/10
  83. 6 октября 2026 года Google DeepMind выпустила EmbeddingGemma 2 — открытую модель эмбеддингов, которая превращает в вект… 7/10
  84. 500B Tokens Later: Letting AI Agents Decompile a First-Person Shooter 7/10
  85. Building an Agent That Can't Afford to Be Wrong: Quran Sanity Agent 6/10
  86. С января 2027 года бренды в США смогут оплатить кусок самого объяснения, которое торговый ассистент Alexa for Shopping … 6/10
  87. Всем привет, меня зовут Марат, последние 15 лет я занимаюсь развитием системы складского учета СКИФ. Система размещаетс… 6/10
  88. 1. Стадия первая: скептицизм 6/10
  89. OriginTrace: Protecting the DEV Community from Content Theft using Sanity Context MCP 6/10
  90. Find My Thingy: A Local-First AI Memory Assistant Powered by Gemma 3 4B 6/10
  91. DocTrace: Investigating Angular Migrations with Sanity Context MCP 6/10
  92. I Built a Recipe Book for My Dadi, Using AI That Never Leaves My Laptop 6/10
  93. Итак, прошло уже больше 2х лет с момента моей последней статьи 6/10
  94. The Witness Was the Suspect: Why AI Audit Logs Can't Be Trusted 6/10
  95. Вводная 6/10
  96. ✍️ MagenticCMS: Rehearse the Comments Before You Publish the Post 6/10
  97. DeepSeek Harness Desktop: приложение для Windows и Mac, установка и плагины 6/10
  98. I Gave My AI Agents Their Own Documentation Crawler, and Pulled 60 Pages of Clean Markdown in 49 Seconds 6/10
  99. TL;DR: В этой статье расскажу, как за полдня с помощью Antigravity и подписки Google AI Pro я собрал полноценную Go-биб… 6/10
  100. За последние пару дней Anthropic забанило много аккаунтов. Точной причины компания не называет, апелляции, судя по пост… 6/10
  101. Здравствуйте дамы и господа. Меня зовут Васильев Стас и я, как многие участники этого прекрасного сообщества, пытаюсь н… 6/10
  102. Ephemeral Testing 6/10
  103. Your AI Agent Will Do Something Terrible. Here's How to Survive It. 6/10
  104. Green Tests, Broken Architecture: Four Models Review TypeScript Diffs 6/10
  105. Introducing Maple: The Frontend Review Toolkit 6/10
  106. Show HN: Durable Actors – OSS Durable Objects with configurable compute 6/10
  107. Помните раньше была такая штука как собеседование по теории? Когда просто задают вопросы а-ля “как работает хеш таблица… 6/10
  108. В какой‑то момент я заметил довольно глупую вещь: чем дольше работаешь с моделями над реальными проектами, тем больше с… 6/10
  109. 6th October 2026 6/10
  110. 6th October 2026 6/10
  111. Show HN: NanoMuse – An open-source AI agent for your phone and computer 6/10
  112. I let my AI agents merge to production. Once. 6/10
  113. В последнее время вокруг систем ИИ, генерирующих тесты, активно развивается дискуссия, причем как в профессиональной, т… 6/10
  114. Temper 0.5B — моя небольшая модель, дообученная на базе Qwen2.5-Coder-0.5B‑Instruct, упор которой сделан на языке Rust.… 6/10
  115. Как часто вы задумываетесь о том, какие модели компьютерного зрения используются на строительных объектах и для чего? С… 6/10
  116. Привет, Хабр! На связи команда Just AI. Сегодня хотим поговорить про Claude Code. Он умеет работать не только с моделям… 6/10
  117. Аннотация 6/10
  118. Введение 6/10
  119. Модель не менялась, набор задач тоже. Но стоило снять ограничения на ресурсы — результат вырос на шесть процентных пунк… 6/10
  120. One Model Family, Two Gold-Level Results: Fine-Tuning Nemotron for IOI and IMO 6/10
  121. Build a web-aware TypeScript agent with Mastra and Zenrows 6/10
  122. У вас есть модель, API к ней и идея продукта с агентом. Кажется, осталось написать цикл: отправить запрос, получить too… 6/10
  123. С чего всё началось 6/10
  124. A Coding System That Refuses to Trust Its Own Output 6/10
  125. Ранее я написал обширную статью про попытки сделать разговоры с NPC SkyrimNet более живыми, но упустил главное… Не расс… 6/10
  126. Multimodal open d1 decision models for the edge 6/10
  127. Meta and Microsoft Limit Employee Use of Claude AI Tools 6/10
  128. Claude Haiku 5.5 6/10
  129. Это не рассказ про кейс заказчика и не отчёт о внедрении Luna Decisions. Ниже - схема мониторинга объявлений, фрагмент … 6/10
  130. Port of the TypeScript compiler, checker and lsp to Rust, by LLM 6/10
  131. За последний год в новостной ленте сложился отдельный жанр коротких историй, у которых почти всегда одинаковое начало и… 6/10
  132. По телеграм-каналам прокатилась очередная волна. Ученые нашли в LLM вектор боли. ИИ способен страдать. Насколько искусс… 6/10
  133. На прошлой неделе я перенес форк Apache Cloudberry на PostgreSQL 19 в виде набора расширений и рассказал, где этот порт… 6/10
  134. I Turned 149k Messy Images into an Offline Recognition System 6/10
  135. Shipping faster with AI isn't engineering maturity. It's a demo that hasn't met year two yet. 6/10
  136. В первой статье мы проверяли, что происходит с агентом после маскирования данных. Здесь другой вопрос: на каких наборах… 6/10
  137. Привет, Хабр! На связи команда Рег.облака. С начала октября у российских пользователей Claude снова начали блокироватьс… 6/10
  138. Google выпустила Nano Banana 2.1 и обещает улучшения «по всем фронтам»: качество, текст в кадре, консистентность персон… 6/10
  139. How Our Engineering Team Uses AI, Part II: Meat Proxies 6/10
  140. REA: Let Your AI Agent Reverse Engineer the App Features You Wish You Had 6/10
  141. В начале сентября Сбер неожиданно выложил открытые веса своей модели GigaChat 3.5 432B. Таким образом, любая компания в… 6/10
  142. Прошлой осенью мы выложили в открытый доступ MWS AI Vision Bench — бенчмарк для оценки мультимодальных моделей на русск… 6/10
  143. Прошлой осенью мы выложили в открытый доступ MWS AI Vision Bench — бенчмарк для оценки мультимодальных моделей на русск… 6/10
  144. Sub-1-Bit LLM Compression via Latent Factorization 6/10
  145. Вайбкодинг <> Документация? 6/10
  146. Я здесь уже рассказывал про Falang (friendly algorithmic language) - универсальное решение для построения блок схем. То… 6/10
  147. Хабы: Изучение языков · Разработка веб-сайтов · Искусственный интеллект · Программирование 6/10
  148. Привет, Хабр! 6/10
  149. TouchGrass: The Open-AI Agent That Succeeds When You Stop Using It 6/10
  150. A sharper eye did not make a more careful model. 6/10
  151. Mxc: Microsoft Execution Containers version 1.0.0 6/10
  152. У Остина Клеона есть короткая книга «Покажи свою работу!» с одной большой идеей: не ждать, пока всё будет готово, а пок… 6/10
  153. Нет никакого смысла нанимать нобелевского лауреата, чтобы он отвечал на однотипные звонки в колл-центр. Примерно так же… 6/10
  154. Я один делаю Кубыш, приложение для личных финансов на iPhone, а код пишет ИИ-агент. У которого два лимита: на 5 часовые… 6/10
  155. Привет, Хабр! 6/10
  156. Punto Switcher для Mac заморожен с ноября 2017 года. Я печатаю на русском и английском целый день, и «ghbdtn» вместо «п… 6/10
  157. Всем привет! Меня зовут Ваня, по призванию системный архитектор в RED Security. Хочу познакомить вас с open-source-реше… 6/10
  158. Двенадцать нейросетей для видео прогнали на одном промпте: 8 секунд, 720p, по одному прогону (одной генерации) на модел… 6/10
  159. Мошеннические схемы становятся все более и более изощренными, а с использованием ботов и нейронок они приобретают массо… 6/10
  160. Представьте себе задачу: найти опухоль на КТ‑снимке любого органа — печени, почки, поджелудочной, легкого, лимфоузла. С… 6/10
  161. I built an offline AI that knows your last frost date, no internet, no API 6/10
  162. Привет, Хабр! 6/10
  163. I Built an AI That Turns “I’m Bored” Into Real-World Side Quests 🌿 6/10
  164. Zero-Screen Dungeon Master: The Voice-Only RPG Where Your Real Walk Drives the Story 6/10
  165. Я хотел разработать собственный AI-процессор, нашёл openTPU, взял FPGA за ~$50 с 4 ГБ оперативной памяти, подключил её … 6/10
  166. The Stack I'd Need for Claude to Direct a Whole YouTube Video in Blender 6/10
  167. Я создал сайт с удивительными фактами об арт искусстве artatlas.site Там около 2000 страниц на четырех разных языках, и… 6/10
  168. 25 сентября 2026 года Anthropic опубликовал «Yes, Claude can do Nine Loops». 6/10
  169. Мы делаем онлайн-платформу для длинных и коротких нард с нейросетевым движком. Движок разбирает партии, сыгранные на пл… 6/10
  170. Я тепломеханик, начальник отдела в проектной организации, в проектировании четырнадцать лет. Программистом не был ни дн… 6/10
  171. Я решил проверить, как далеко можно зайти, если обучать скрытый слой нейросети вообще без обратного распространения оши… 6/10
  172. Производительность агентного SQL на уровне передовых моделей теперь помещается прямо на ноутбуке – даже если ему почти … 6/10
  173. My personal AI agent posted my bank details on company Slack 6/10
  174. Час-два записанного материала у меня частенько растягивались на целый вечер или два чистого монтажа, а сейчас – несколь… 6/10
  175. Я к вам пишу — чего же боле? 6/10
  176. Пост 2 — Оракульное смещение 6/10
  177. Хочу рассказать об интересном подходе к построению ML-моделей. Как известно, практически любая нейросеть - это, грубо г… 6/10
  178. Попробуйте объяснить ребёнку, почему кружка, столкнутая со стола, разбивается. Вы вряд ли начнёте с закона всемирного т… 6/10

Edit page
Share this post:

Next Post
AI-радар — 10 октября