Набор навыков и методология для кодинг-агентов: сначала уточнить задачу, спланировать, писать тесты, потом код. Агент работает дисциплинированнее.
База репозиториев AI-движения
Лучшие AI-репозитории
224 живых проекта — от агентных фреймворков до защиты от prompt injection. У каждого наше описание: зачем он, кому подойдёт и как начать за три шага.
Звёзды, форки и активность обновляем каждый день через GitHub API · обновлено 6 октября 2026 г.
- репозиториев
- 224
- категорий
- 11
- звёзд суммарно
- 11 млн
- новых звёзд за 30 дней
- +235 тыс.
За 30 дней
Растут быстрее всех
Больше всего новых звёзд за последние 30 дней.
Сервис, который превращает любой сайт в чистый Markdown или структурированные данные для моделей. Умеет искать, скрейпить, обходить сайт целиком и даже кликать по странице.
Небольшая утилита от Microsoft: превращает PDF, Word, PowerPoint, Excel и другие файлы в Markdown, который удобно отдавать языковой модели.
Открытый кодинг-агент для терминала с десктопным приложением. Не привязан к одному провайдеру: подключаешь модели, какие есть.
Набор инструментов для разработки от спецификации: сначала принципы и спека, затем план и задачи, и только потом код. Работает с разными кодинг-агентами.
Лёгкий кодинг-агент от OpenAI, который запускается в терминале и работает с кодом проекта. Написан на Rust.
Категории
Каталог
13 репозиториев
Открытая платформа, где видно каждый вызов модели: трейсы, стоимость, оценки качества и версии промптов. Можно использовать в облаке или развернуть у себя.
Инструменты для агентов, которые управляют компьютером: драйверы для разных ОС, виртуальные машины и бенчмарки для обучения и оценки.
Давняя платформа для ML, которая теперь умеет и LLM-приложения: трейсинг, оценка, реестр промптов и шлюз к моделям. Подключается к большинству фреймворков.
Командная утилита для тестов промптов и агентов: описываешь кейсы в конфиге и сравниваешь модели. Умеет и red teaming, поиск уязвимостей. Подключается к CI.
Платформа для отладки и оценки LLM-приложений: трейсы, автоматические проверки качества и дашборды. Поддерживает RAG и агентные цепочки, можно развернуть у себя.
Кодовый фреймворк Google для агентов: строишь их на Python, прогоняешь оценку и разворачиваешь. Заточен под Gemini, но работает и с другими моделями.
Фреймворк для тестирования LLM-приложений в стиле pytest: готовые метрики для RAG, агентов и чат-ботов, проверка по трейсам. Результаты можно выгружать в облако.
Библиотека метрик для оценки RAG и других LLM-приложений: проверяет, насколько ответ опирается на найденные источники. Умеет генерировать тестовые наборы.
Стандартный набор для прогона моделей через сотни академических бенчмарков. На нём строятся многие открытые рейтинги моделей.
Инструмент наблюдаемости и оценки для LLM: запускается локально одной командой и показывает трейсы, эксперименты и наборы данных. Построен на OpenTelemetry.
Главный бенчмарк для кодинг-агентов: модель должна исправить реальные issue из GitHub-проектов, а патч проверяется тестами в контейнерах.
Фреймворк оценки моделей от британского Института безопасности ИИ: инструменты, многошаговые диалоги, проверка другой моделью и более 200 готовых оценок.
Бенчмарк сложных задач в терминале: набор заданий и среда запуска, в которой агент работает как админ или разработчик. Есть таблица лидеров.
Мы что-то упустили?
Предложить репозиторий
Пришли ссылку на GitHub и пару слов, почему он здесь нужен. Каждую заявку смотрим руками — в каталог попадает не всё.










