База репозиториев AI-движения

Лучшие AI-репозитории

224 живых проекта — от агентных фреймворков до защиты от prompt injection. У каждого наше описание: зачем он, кому подойдёт и как начать за три шага.

Звёзды, форки и активность обновляем каждый день через GitHub API · обновлено 6 октября 2026 г.

репозиториев
224
категорий
11
звёзд суммарно
11 млн
новых звёзд за 30 дней
+235 тыс.

За 30 дней

Растут быстрее всех

Больше всего новых звёзд за последние 30 дней.

Весь рейтинг роста
Растёт быстрее всехНовичок месяца

Набор навыков и методология для кодинг-агентов: сначала уточнить задачу, спланировать, писать тесты, потом код. Агент работает дисциплинированнее.

296 тыс.звёзд+15 тыс. за 30 дн.Shell

firecrawl

firecrawl

Растёт быстрее всех

Сервис, который превращает любой сайт в чистый Markdown или структурированные данные для моделей. Умеет искать, скрейпить, обходить сайт целиком и даже кликать по странице.

189 тыс.звёзд+12 тыс. за 30 дн.TypeScript

microsoft

markitdown

Растёт быстрее всех

Небольшая утилита от Microsoft: превращает PDF, Word, PowerPoint, Excel и другие файлы в Markdown, который удобно отдавать языковой модели.

189 тыс.звёзд+11 тыс. за 30 дн.Python

anomalyco

opencode

Растёт быстрее всех

Открытый кодинг-агент для терминала с десктопным приложением. Не привязан к одному провайдеру: подключаешь модели, какие есть.

212 тыс.звёзд+7,6 тыс. за 30 дн.TypeScript

github

spec-kit

Растёт быстрее всех

Набор инструментов для разработки от спецификации: сначала принципы и спека, затем план и задачи, и только потом код. Работает с разными кодинг-агентами.

140 тыс.звёзд+7,1 тыс. за 30 дн.Python

openai

codex

Растёт быстрее всех

Лёгкий кодинг-агент от OpenAI, который запускается в терминале и работает с кодом проекта. Написан на Rust.

128 тыс.звёзд+6,8 тыс. за 30 дн.Rust

Категории

Агентные фреймворкиФреймворки и оркестрация: из чего собирают агентов и мультиагентные системы.23 репозиторияКодинг-агенты и CLIАгенты, которые пишут код в терминале и редакторе, и методики работы с ними.21 репозиторийMCPСпецификация, официальные SDK и лучшие серверы Model Context Protocol.20 репозиториевОткрытые модели и инференсОткрытые веса, локальный запуск, быстрый инференс и дообучение.38 репозиториевRAG и векторные БДПоиск по своим данным: парсинг документов, краулеры, векторные базы, графы знаний.19 репозиториевEvals и наблюдаемостьКак измерить качество модели и агента и что происходит у него внутри.17 репозиториевПромптинг и контекстПромпты, структурированный вывод, навыки и контекст-инжиниринг.16 репозиториевГолос, видео, мультимодальностьРаспознавание и синтез речи, голосовые агенты, картинки и видео.19 репозиториевАвтоматизацияВоркфлоу без кода, агенты в браузере и на компьютере.15 репозиториевAwesome-списки и обучениеКурсы, книги и awesome-списки, с которых стоит начинать.21 репозиторийБезопасностьPrompt injection, guardrails, red teaming и сканеры агентов.15 репозиториевНе нашёл свой любимый?Предложи репозиторий — посмотрим и добавим, если он того стоит.Предложить репозиторий →

Каталог

12 репозиториев

trycua

cua

Растёт быстрее всех

Инструменты для агентов, которые управляют компьютером: драйверы для разных ОС, виртуальные машины и бенчмарки для обучения и оценки.

28 тыс.звёзд+6,2 тыс. за 30 дн.2 тыс.RustКоммит сегодня

SWE-agent

SWE-agent

Исследовательский агент из Принстона и Стэнфорда: берёт GitHub-issue и пытается его починить. Задал планку на SWE-bench; авторы теперь советуют mini-swe-agent.

20 тыс.звёзд+271 за 30 дн.2,2 тыс.PythonКоммит сегодня

openai

evals

Фреймворк OpenAI для оценки моделей и реестр готовых бенчмарков. Исторически важный проект: по нему видно, как устроены шаблоны оценок.

20 тыс.звёзд+181 за 30 дн.3,1 тыс.PythonКоммит 6 месяцев назад

Стандартный набор для прогона моделей через сотни академических бенчмарков. На нём строятся многие открытые рейтинги моделей.

14 тыс.звёзд+242 за 30 дн.3,6 тыс.PythonКоммит 22 дня назад

SWE-bench

SWE-bench

Главный бенчмарк для кодинг-агентов: модель должна исправить реальные issue из GitHub-проектов, а патч проверяется тестами в контейнерах.

6 тыс.звёзд+197 за 30 дн.1 тыс.PythonКоммит 18 дней назад

AgentOps-AI

agentops

SDK для наблюдения за агентами: записывает сессии, считает стоимость и показывает цепочку шагов. Интегрируется с CrewAI, LangChain, OpenAI Agents SDK и другими.

5,9 тыс.звёзд642PythonКоммит 3 месяца назад

fchollet

ARC-AGI

Знаменитый тест на абстрактное мышление: 800 задач-головоломок на цветных сетках, где нужно по нескольким примерам угадать правило. Людям они даются легко, моделям долго были не по силам. В репозитории данные и страница для ручного решения.

4,8 тыс.звёзд+19 за 30 дн.726JavaScriptКоммит 1 год назад

meta-llama

PurpleLlama

Проект Meta по безопасности генеративного ИИ: модели-фильтры Llama Guard и Prompt Guard, сканер Code Shield и набор тестов CyberSec Eval. Объединяет защиту и проверку атакой.

4,4 тыс.звёзд+45 за 30 дн.777PythonКоммит 6 дней назад

EleutherAI

pythia

Набор из восьми моделей разного размера, обученных на одних и тех же данных, с 154 сохранёнными чекпоинтами. Нужен, чтобы изучать, как модель учится и когда в ней появляются знания.

3 тыс.звёзд+39 за 30 дн.225Jupyter NotebookКоммит 11 месяцев назад

UKGovernmentBEIS

inspect_ai

Фреймворк оценки моделей от британского Института безопасности ИИ: инструменты, многошаговые диалоги, проверка другой моделью и более 200 готовых оценок.

2,9 тыс.звёзд+227 за 30 дн.773PythonКоммит 1 день назад

harbor-framework

terminal-bench-1

Бенчмарк сложных задач в терминале: набор заданий и среда запуска, в которой агент работает как админ или разработчик. Есть таблица лидеров.

2,6 тыс.звёзд572PythonКоммит 3 месяца назад

ethz-spylab

agentdojo

Динамическая среда для оценки атак и защит для LLM-агентов. Запускает агента на задачах пользователя и проверяет, удастся ли внедрить вредную инструкцию.

892звёзд+91 за 30 дн.234PythonКоммит 4 месяца назад

Мы что-то упустили?

Предложить репозиторий

Пришли ссылку на GitHub и пару слов, почему он здесь нужен. Каждую заявку смотрим руками — в каталог попадает не всё.