⚡️ Agent Audit. Скилл, который тестирует вашего телеграм-бота как живой человек и в хвост и в гриву
Один из основных интерфейсов для моих командных агентов в агентстве — тележонька. Ну потому что это удобно и не надо каждого обучать чему-то новому.
Максимальная имитация работы с человеком.
Но есть и большая проблема в таком решении — куча багов в пользовательских сценариях. Всё сразу не предусмотреть же, да и рядовой пользователь не должен думать о том, «как ему правильно спросить агента».
Как бы ни спросил, какой бы идиотский сценарий ни выдал кожаный — должно работать!
А следовательно, надо все эти сценарии прогонять и смотреть, где ломается. Ну и чинить потом.
Короче, я сначала хотел сделать ассистента, который помогает СОБИРАТЬ агентов. А по ходу выяснилось, что ПРОВЕРЯТЬ работу агентов куда важнее, чем первая сборка, и ест куда больше моего времени.
В итоге вместо создателя получился аудитор.
Он берёт бота, проходит его глазами обычного пользователя и ищет дыры по куче категорий. Потом находки перепроверяет независимый судья, на выходе выдаёт отчёт, понятный человеку без знания технических нюансов. **
Это важно!
И на днях добавил в скилл вообще офигенную фичу 👇
**✦ ЖИВОЙ ПРОГОН
Аудитор садится в НАСТОЯЩИЙ Telegram под вашим аккаунтом и гоняет его как живой человек.
Жмёт кнопки, пишет одно и то же в трёх формулировках, кидает всякий мусор, возвращается «после паузы» и спрашивает «где мы» и тестит кучу других сценариев.
Можно для красоты поставить окно телеги рядом с Claude Code и просто смотреть, как он там шуршит за вас.
👆 Вот это, конечно, космос.
Если нейронка не умеет пока ходить в телегу, то я добавил в скилл соответствующую инструкцию. Не захочется пускать автоматизацию в аккаунт — есть ассистированный режим, где нейромозг диктует шаги, а человек нажимает. Но, это такое себе.
Тестирует долго, тестирует качественно (потому и долго), и лучше использовать что-то мощное, типа Opus и выше.
На моём агенте Арсении товарищ за технические тесты выдал 84 находки, а живой прогон за полдня добавил ещё 18 критических багов. Две из них по коду в принципе не видны.
Короче, я перестал выискивать глюки сам, тыкая в бота по сценариям. Автоматизировал это и радуюсь.
Штука абсолютно безвозмездная, забирайте. Что не сработает или захочется докрутить — пишите в комментах, буду чинить.
А если зашло, то ⚡️ под постом и ⭐️ на гитхабе. Так будет приятно и полезно!
👉 https://github.com/TimurUgulava/agent-audit
#skills
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | Продолжаю разбирать масштабный отчет Гугла про внедрение нейросетей. Очередь дошла ... | 0 | 6.21 | 05-08-2026 |
| 2 | Я дал AI-агенту доступ к своему Telegram. Вот что из этого получилось | 0 | 7.64 | 18-08-2026 |
| 3 | Der KI-Delegations-Audit: Vertrauen ist gut, KI-Kontrolle ist besser 🇩🇪 | 0 | 6 | 02-07-2026 |
| 4 | Сейчас куда ни посмотри — везде какие-то автоматические контент-заводы. Агенты, ... | 0 | 12.27 | 27-07-2026 |
| 5 | [Free Tutorial] Master Building AI Agents | 0 | 6.66 | 13-07-2026 |
| 6 | Как я написал Telegram-бота для SEO-аудита и не дал ему стать инструментом для атак | 0 | 17.31 | 18-02-2026 |
| 7 | Главное про нейросети за сегодняшний день: 🔍 Новый скилл для ... | 0 | 13.2 | 24-07-2026 |
| 8 | Как агент сам откроет дверь хакеру? Разбираю три реальных пробоя AI-агентов и почему обычный ред-тиминг их не найдёт | 5 | 8 | 28-06-2026 |
| 9 | Мой агент Ouroboros побил Codex с Claude Code на Terminal-Bench, OSWorld и CL-Bench. Он написал себя сам | 0 | 9.5 | 31-07-2026 |