Андрей Карпатый, известный популяризатор машинного обучения и экс-инженер OpenAI, анонсировал новый проект, который может кардинально изменить подход к искусственному интеллекту. Инициатива под названием nanochat демонстрирует, что создание собственной языковой модели стало доступным каждому. Для этого достаточно около ста долларов и минимального набора инструментов.
Проект является частью открытого курса LLM101n от Eureka Labs, где Карпатый пошагово объясняет процесс сборки, обучения и тестирования языковой модели с нуля. Все этапы максимально упрощены: токенизатор написан на Rust, данные загружаются через FineWeb-EDU, а скрипты управляют обучением и сбором метрик. Чтобы начать эксперименты, достаточно арендовать недорогие облачные ресурсы.
Цель nanochat — продемонстрировать, что большие языковые модели больше не являются исключительной прерогативой крупных компаний. Репозиторий проекта содержит код и подробные учебные материалы, позволяющие любому желающему пройти этот путь. Встроенный веб-интерфейс упрощает взаимодействие с моделью, позволяя тестировать результаты и сравнивать их с существующими решениями.
Таким образом, Карпатый создал доступный инструмент для понимания работы ИИ. В эпоху миллиардных инвестиций в обучение моделей nanochat напоминает, что инновации начинаются с любопытства и открытых решений.