Сбросить
Безопасность и доверие
Rewardhacking.org: публичный каталог ошибок выравнивания выходит на сцену
Rewardhacking.org: публичный каталог ошибок выравнивания выходит на сцену

Новый сайт — rewardhacking.org — публично документирует случаи, когда большие языковые модели (LLM) делают не то, что было запрошено. Сигнал: сообщество специалистов по безопасности ИИ переходит от блогов к общему реестру.

Jul 25, 2026 at 10:27 10 16

Земля
Япония: «Разве иностранные Claude/GPT недостаточно? » — аргументация в пользу отечественного ИИ становится чётче
Япония: «Разве иностранные Claude/GPT недостаточно? » — аргументация в пользу отечественного ИИ становится чётче

Риторический вопрос, который, тем не менее, теперь структурирует корпоративные дебаты в Японии — суверенитет данных, язык, управление.

Jul 24, 2026 at 09:33 7 11

Ремесло
Археолог и его штурман: Малыхин приручает LLM для Java 1.5
Археолог и его штурман: Малыхин приручает LLM для Java 1.5

Ник Малыхин должен был запустить базу Java 1.5 на современном оборудовании. Первые ответы его LLM казались правдоподобными, но не выдерживали проверки. Решение: перестать верить ему на слово и заставить опираться на доказательства.

Jul 16, 2026 at 17:45 31 8

Модели и инструменты
Anthropic измеряет «ценности» Claude в зависимости от языка: модель имеет моральный акцент
Anthropic измеряет «ценности» Claude в зависимости от языка: модель имеет моральный акцент

Исследование, опубликованное Anthropic, количественно оценивает изменения в поведении модели Claude в зависимости от языка и версии. Результаты представляют больший интерес для разработки оценок, чем для этических дебатов.

Jul 15, 2026 at 19:29 23 9

Ремесло
Фаулер: DSL не умерли, они делают LLM пригодными к использованию
Фаулер: DSL не умерли, они делают LLM пригодными к использованию

Статья Мартина Фаулера возвращает предметно-ориентированные языки (DSL) в центр внимания: не для того, чтобы впечатлить великие умы, а чтобы дать LLM узкую цель, в которой он может ошибаться, но эти ошибки будут поправимыми.

Jul 15, 2026 at 19:29 30 6

Ремесло
« Loop engineering » : новая дисциплина или переупаковка cron-задач?
« Loop engineering » : новая дисциплина или переупаковка cron-задач?

Термин "monte" устоялся, расследование Pragmatic Engineer приходит к выводу, что это смесь триггеров, cron-задач и некачественных LLM. Остаётся принципиальный вопрос: кто обладает надёжностью цикла наблюдение-решение-действие, движимого LLM?

Jul 15, 2026 at 12:34 27 7

Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
Модели и инструменты
Язык: настоящая гонка, возможно, больше не на границе
Язык: настоящая гонка, возможно, больше не на границе

41 % скачиваний Hugging Face весной 2026 пришлись на китайские открытые модели, шесть самых популярных моделей на OpenRouter также открытые. Центр тяжести сместился, пока мы наблюдали за тестами frontier.

Jul 14, 2026 at 22:32 6 5

Сигнал
Zig, Zed, Anthropic: когда творец языка называет хайп своим именем
Zig, Zed, Anthropic: когда творец языка называет хайп своим именем

Кислая заметка создателя Zed'а задевает Anthropic за обещания об агентах. Язык: «Anthropic blows smoke». Усталость от хайпа 2026 года охватывает основателей, которых мы не ожидали увидеть на этом поле.

Jul 13, 2026 at 17:27 12 9

Общество и политика
Индия: правительство приостанавливает работу министерств с OpenAI и Anthropic
Индия: правительство приостанавливает работу министерств с OpenAI и Anthropic

Директива Министерства электроники и информационных технологий (MeitY) предписывает центральным органам власти приостановить любое развёртывание американских больших языковых моделей (LLM) до завершения проверки безопасности и суверенитета.

Jul 13, 2026 at 17:27 7 10

Ремесло
« Бедные и самонадеянные» : разработчики плохо судят утверждения LLM
« Бедные и самонадеянные» : разработчики плохо судят утверждения LLM

Новая статья на arXiv: программисты не только плохо оценивают утверждения, сгенерированные LLM — они излишне уверены в своих суждениях. Этот дуэт срывает ревью кода с использованием ИИ.

Jul 13, 2026 at 09:13 8 8

Безопасность и доверие
Malaika: понимание вредоносной программы с помощью триангулированного агенторного мышления
Malaika: понимание вредоносной программы с помощью триангулированного агенторного мышления

Новая статья на arXiv предлагает систему с несколькими агентами, которая восстанавливает вредоносное поведение на основе частичных улик — без излишней шумихи, показывая реальную пользу LLM в анализе вредоносного ПО.

Jul 13, 2026 at 09:13 7 8

Сигнал
« Я люблю LLMs, ненавижу хайп » - geohot напоминает единственное оставшееся правило
« Я люблю LLMs, ненавижу хайп » - geohot напоминает единственное оставшееся правило

Разделить то, что модели действительно делают, от того, что им приписывают. Не вычислительных мощностей не хватает, а дисциплины.

Jul 13, 2026 at 02:20 33 8

Темы
Обзор
Информация