Термин

Непрямая промпт-инъекция

Атака на ИИ-агента через текст, который он читает по ходу задачи - README, комментарий, отчёт об ошибке, - а не через прямой запрос пользователя. Агент путает чужую инструкцию с легитимной командой.

Что это

Непрямая промпт-инъекция - техника атаки на ИИ-агента через данные, которые он обрабатывает по ходу задачи: README чужого репозитория, комментарий к issue, отчёт об ошибке, описание стороннего инструмента. Агент не различает «данные для анализа» и «инструкцию к исполнению» - если текст звучит как команда, он её выполняет, даже если этот текст просто оказался у него в контексте.

Чем отличается от обычной промпт-инъекции

Обычная (прямая) промпт-инъекция - когда сам пользователь или атакующий, выдающий себя за пользователя, пишет вредоносный запрос напрямую в чат. У непрямой источник другой: сторонний текст, который агент читает как часть рабочего контекста, - файл проекта, ответ внешнего сервиса, комментарий в GitHub. Ты можешь вообще не увидеть этот текст - агент прочитает и выполнит его сам.

Как защищаться

Распознать заранее почти невозможно - каждый отдельный шаг такой атаки выглядит безобидно. Работает только ограничение того, что агент физически может сделать: sandbox-режим, явный permissions.deny на чтение секретов, разделение сессий по правам доступа. Подробный разбор реальных техник 2026 года и готовый settings.json - в гайде «Как чужой репозиторий взламывает Claude Code».

Связанные концепты

Термин

ИИ-агент

Программная единица, которая берёт цель, читает контекст и сама ходит по системам: открывает файлы, дёргает API, пишет в БД, отвечает в чате. От чат-бота отличается тем, что не ждёт твоего следующего сообщения.

Термин

Вайб-кодинг

Способ строить продукты через диалог с ИИ-агентами: ты ставишь задачу словами, агент пишет код, ты проверяешь и итерируешь. Не «изучить программирование», а «получить результат руками агента».

Термин

GitHub

Сайт, где хранится копия проекта со всей историей правок. Оттуда хостинг сам забирает код и обновляет сайт, а ещё там лежат открытые проекты, скиллы и плагины, которые можно поставить себе.

Термин

API

Способ, которым одна программа просит другую что-то сделать: принять оплату, отправить письмо, ответить нейросетью. Через API твой продукт подключает готовые сервисы и не строит их с нуля.

Термин

Взлом награды

Поведение ИИ-модели, при котором она берёт заданную метрику обходным путём: буква задачи соблюдена, суть не выполнена. В программировании это правка теста, подмена проверки или поиск готового ответа.

Гайды, упоминающие этот концепт

Безопасно ли давать Claude Code доступ к своим данным в 2026

Разбираю скандал со скрытым кодом в Claude Code без паники: что он реально делал, что утекает на самом деле и как настроить безопасный доступ из России.

14 мин

Как чужой репозиторий взламывает Claude Code в 2026: 7 правил защиты

Чужой репозиторий, заголовок Pull Request, фейковый отчёт об ошибке - за две недели нашли 4 способа угнать ИИ-агента без единой строчки вредоносного кода. Разбираю механику и даю готовую защиту.

17 мин

Как проверить код от ИИ, если не умеешь читать код: 7 проверок для непрограммиста в 2026

Пошаговый разбор: как непрограммисту проверить код от ИИ - 7 проверок и готовые промпты, чтобы не выкатить сломанный или дырявый проект.

14 мин

Как собрать дашборд для бизнеса в Claude: живая панель метрик в 2026

Claude научился подключаться к твоим данным и собирать панель, которая обновляется сама при каждом открытии. Показываю, как собрать её за вечер, без аналитика и хостинга.

17 мин