Текстовая модель

LLaMA — открытые языковые модели

Открытые модели LLaMA в GPTunneL: контекст 1 млн токенов, свободная лицензия, низкая цена. Доступ из России без VPN, оплата рублями за токены.

Чем сильна линейка LLaMA

Свойства, которые Meta держит от поколения к поколению — на них можно рассчитывать, какую бы модель вы ни выбрали.

Открытые веса

Главное отличие линейки: модели опубликованы и их можно запускать на своём сервере. Ни у ChatGPT, ни у Claude такого нет.

Низкая цена

Открытость даёт конкуренцию среди тех, кто эти модели запускает, — и цена держится заметно ниже закрытых аналогов.

Контекст 1M токенов

Старшие модели четвёртого поколения удерживают миллион токенов — подшивку документов или большой проект целиком.

Основа для дообучения

Большинство открытых моделей на рынке выросли из LLaMA: под неё больше всего готовых дообученных версий и инструментов.

Какую модель выбрать

В сервисе две актуальные модели четвёртого поколения — они различаются размером и назначением.

ScoutУниверсальный выборMaverickСложные задачи
Под чтоПовседневные тексты, переписка, простой кодСложные рассуждения, анализ, большие документы
Контекст1M токенов1M токенов
СкоростьВысокаяСредняя
ЦенаНизкаяСредняя

Характеристики — по данным каталога платформы. Точные цены каждой модели — на странице Цены

Все модели LLaMA

Даты выхода моделей по официальным анонсам Meta.

Апрель 2025

LLaMA 4 ScoutLLaMA 4 Maverick

Первое поколение с миллионом токенов контекста. Scout — рабочая модель на каждый день, Maverick — под задачи потяжелее.

Декабрь 2024

LLaMA 3.3 70B

Модель на 70 миллиардов параметров, догнавшая по качеству прошлые флагманы втрое большего размера.

Июль — сентябрь 2024

LLaMA 3.1LLaMA 3.2

Контекст вырос до 128 тысяч токенов, появились совсем компактные версии и первые модели с пониманием изображений.

Апрель 2024

LLaMA 3

Поколение, с которого открытые модели впервые всерьёз сравнили с закрытыми флагманами.

Июль 2023

LLaMA 2

Первая версия, которую разрешили использовать коммерчески. С неё началась вся экосистема открытых моделей.

Вся история линейки
Февраль 2023

LLaMA 1

Исследовательский релиз, с которого началась история открытых больших языковых моделей.

Как устроена оплата

Подписки нет: вы пополняете общий баланс и тратите его на любую модель платформы.

Оплата за токены

Списывается ровно за то, что ушло на запрос и ответ. Не пользовались — не платите, лимитов и абонентской платы нет.

Один баланс на все модели

LLaMA, ChatGPT, Claude, генерация картинок и видео — из одного кошелька. Отдельная подписка на каждый сервис не нужна.

Оплата российскими картами

Пополнение в рублях картой российского банка, минимальная сумма — 50 ₽. Зарубежная карта не нужна.

Как начать работать с LLaMA

Вход в GPTunneL
Один аккаунт на все модели платформы.
Составь план статьи о переходе компании на удалённую работу
LLaMA 4 Scout
План статьи

Начните с цифр: сколько сотрудников перешло, за какой срок и что стало с производительностью.

Основной блок — три сложности, с которыми столкнулись, и что сработало против каждой.

В конце — чек-лист для компаний, которые только собираются переходить.

Вход любым удобным для вас способом.

Модель переключается прямо в поле ввода — менять её можно посреди диалога.

Ответ приходит в чат, контекст сохраняется до конца диалога.

Попробуйте LLaMA в GPTunneL

Регистрация занимает минуту, а баланс можно пополнить на 50 ₽ и посмотреть, подходит ли модель под вашу задачу.

Частые вопросы

Нет. Запросы идут через инфраструктуру GPTunneL, поэтому модели открываются из России как обычный сайт — без VPN, прокси и зарубежной карты.

LLaMA — линейка открытых нейросетей компании Meta и основа почти всей экосистемы открытых моделей: большинство свободных языковых моделей на рынке так или иначе выросли из неё.

Главное отличие от ChatGPT и Claude — опубликованные веса. Модель можно скачать и запустить на своём сервере, а значит, её никто не отключит и не изменит без предупреждения. Из открытости следует и цена: запускать LLaMA может кто угодно, конкуренция держит стоимость заметно ниже закрытых аналогов. Старшие модели четвёртого поколения удерживают в контексте миллион токенов. Русский язык линейка знает, хотя в тонкостях стиля уступает флагманам.

В GPTunneL модели LLaMA доступны без своего сервера — из России, без VPN и зарубежной карты, с оплатой российскими картами в рублях и списанием только за фактически потраченные токены.