База репозиториев AI-движения

Лучшие AI-репозитории

224 живых проекта — от агентных фреймворков до защиты от prompt injection. У каждого наше описание: зачем он, кому подойдёт и как начать за три шага.

Звёзды, форки и активность обновляем каждый день через GitHub API · обновлено 6 октября 2026 г.

репозиториев
224
категорий
11
звёзд суммарно
11 млн
новых звёзд за 30 дней
+235 тыс.

За 30 дней

Растут быстрее всех

Больше всего новых звёзд за последние 30 дней.

Весь рейтинг роста
Растёт быстрее всехНовичок месяца

Набор навыков и методология для кодинг-агентов: сначала уточнить задачу, спланировать, писать тесты, потом код. Агент работает дисциплинированнее.

296 тыс.звёзд+15 тыс. за 30 дн.Shell

firecrawl

firecrawl

Растёт быстрее всех

Сервис, который превращает любой сайт в чистый Markdown или структурированные данные для моделей. Умеет искать, скрейпить, обходить сайт целиком и даже кликать по странице.

189 тыс.звёзд+12 тыс. за 30 дн.TypeScript

microsoft

markitdown

Растёт быстрее всех

Небольшая утилита от Microsoft: превращает PDF, Word, PowerPoint, Excel и другие файлы в Markdown, который удобно отдавать языковой модели.

189 тыс.звёзд+11 тыс. за 30 дн.Python

anomalyco

opencode

Растёт быстрее всех

Открытый кодинг-агент для терминала с десктопным приложением. Не привязан к одному провайдеру: подключаешь модели, какие есть.

212 тыс.звёзд+7,6 тыс. за 30 дн.TypeScript

github

spec-kit

Растёт быстрее всех

Набор инструментов для разработки от спецификации: сначала принципы и спека, затем план и задачи, и только потом код. Работает с разными кодинг-агентами.

140 тыс.звёзд+7,1 тыс. за 30 дн.Python

openai

codex

Растёт быстрее всех

Лёгкий кодинг-агент от OpenAI, который запускается в терминале и работает с кодом проекта. Написан на Rust.

128 тыс.звёзд+6,8 тыс. за 30 дн.Rust

Категории

Агентные фреймворкиФреймворки и оркестрация: из чего собирают агентов и мультиагентные системы.23 репозиторияКодинг-агенты и CLIАгенты, которые пишут код в терминале и редакторе, и методики работы с ними.21 репозиторийMCPСпецификация, официальные SDK и лучшие серверы Model Context Protocol.20 репозиториевОткрытые модели и инференсОткрытые веса, локальный запуск, быстрый инференс и дообучение.38 репозиториевRAG и векторные БДПоиск по своим данным: парсинг документов, краулеры, векторные базы, графы знаний.19 репозиториевEvals и наблюдаемостьКак измерить качество модели и агента и что происходит у него внутри.17 репозиториевПромптинг и контекстПромпты, структурированный вывод, навыки и контекст-инжиниринг.16 репозиториевГолос, видео, мультимодальностьРаспознавание и синтез речи, голосовые агенты, картинки и видео.19 репозиториевАвтоматизацияВоркфлоу без кода, агенты в браузере и на компьютере.15 репозиториевAwesome-списки и обучениеКурсы, книги и awesome-списки, с которых стоит начинать.21 репозиторийБезопасностьPrompt injection, guardrails, red teaming и сканеры агентов.15 репозиториевНе нашёл свой любимый?Предложи репозиторий — посмотрим и добавим, если он того стоит.Предложить репозиторий →

Каталог

13 репозиториев

langfuse

langfuse

Открытая платформа, где видно каждый вызов модели: трейсы, стоимость, оценки качества и версии промптов. Можно использовать в облаке или развернуть у себя.

35 тыс.звёзд+1,2 тыс. за 30 дн.3,9 тыс.TypeScriptКоммит 1 день назад

trycua

cua

Растёт быстрее всех

Инструменты для агентов, которые управляют компьютером: драйверы для разных ОС, виртуальные машины и бенчмарки для обучения и оценки.

28 тыс.звёзд+6,2 тыс. за 30 дн.2 тыс.RustКоммит сегодня

mlflow

mlflow

Давняя платформа для ML, которая теперь умеет и LLM-приложения: трейсинг, оценка, реестр промптов и шлюз к моделям. Подключается к большинству фреймворков.

28 тыс.звёзд+455 за 30 дн.6,4 тыс.PythonКоммит 1 день назад

promptfoo

promptfoo

Командная утилита для тестов промптов и агентов: описываешь кейсы в конфиге и сравниваешь модели. Умеет и red teaming, поиск уязвимостей. Подключается к CI.

26 тыс.звёзд+919 за 30 дн.2,4 тыс.TypeScriptКоммит 1 день назад

comet-ml

opik

Платформа для отладки и оценки LLM-приложений: трейсы, автоматические проверки качества и дашборды. Поддерживает RAG и агентные цепочки, можно развернуть у себя.

22 тыс.звёзд+618 за 30 дн.1,8 тыс.PythonКоммит сегодня

Кодовый фреймворк Google для агентов: строишь их на Python, прогоняешь оценку и разворачиваешь. Заточен под Gemini, но работает и с другими моделями.

22 тыс.звёзд+326 за 30 дн.4,1 тыс.PythonКоммит 1 день назад

confident-ai

deepeval

Фреймворк для тестирования LLM-приложений в стиле pytest: готовые метрики для RAG, агентов и чат-ботов, проверка по трейсам. Результаты можно выгружать в облако.

19 тыс.звёзд+533 за 30 дн.2 тыс.PythonКоммит 3 дня назад

vibrantlabsai

ragas

Библиотека метрик для оценки RAG и других LLM-приложений: проверяет, насколько ответ опирается на найденные источники. Умеет генерировать тестовые наборы.

16 тыс.звёзд+322 за 30 дн.1,7 тыс.PythonКоммит 7 месяцев назад

Стандартный набор для прогона моделей через сотни академических бенчмарков. На нём строятся многие открытые рейтинги моделей.

14 тыс.звёзд+242 за 30 дн.3,6 тыс.PythonКоммит 22 дня назад

Arize-ai

phoenix

Инструмент наблюдаемости и оценки для LLM: запускается локально одной командой и показывает трейсы, эксперименты и наборы данных. Построен на OpenTelemetry.

12 тыс.звёзд+403 за 30 дн.1,2 тыс.PythonКоммит сегодня

SWE-bench

SWE-bench

Главный бенчмарк для кодинг-агентов: модель должна исправить реальные issue из GitHub-проектов, а патч проверяется тестами в контейнерах.

6 тыс.звёзд+197 за 30 дн.1 тыс.PythonКоммит 18 дней назад

UKGovernmentBEIS

inspect_ai

Фреймворк оценки моделей от британского Института безопасности ИИ: инструменты, многошаговые диалоги, проверка другой моделью и более 200 готовых оценок.

2,9 тыс.звёзд+227 за 30 дн.773PythonКоммит 1 день назад

harbor-framework

terminal-bench-1

Бенчмарк сложных задач в терминале: набор заданий и среда запуска, в которой агент работает как админ или разработчик. Есть таблица лидеров.

2,6 тыс.звёзд572PythonКоммит 3 месяца назад

Мы что-то упустили?

Предложить репозиторий

Пришли ссылку на GitHub и пару слов, почему он здесь нужен. Каждую заявку смотрим руками — в каталог попадает не всё.