Model reference · open weights

ruadapt_qwen2.5_7B_ext_u48

Available as managed deployment LLMs RefalMachine · community Text gen 1 variants 58k dl/mo

ruadapt_qwen2.5_7B_ext_u48 is an open-weight language model from RefalMachine. AxForge deploys and operates it for you on dedicated EU-owned hardware — with the licence handled where one is required.

Available as managed deployment — configured and operated for you on dedicated EU hardware, quoted per deployment.

What it is

Released byRefalMachine
TypeLanguage models
TaskText gen
Parameters (lead)7.6B
Context32k tokens
Released2024-10-26
Popularity58k downloads / month
LicenceUnknown

About

What ruadapt_qwen2.5_7B_ext_u48 is

Описание модели

WORK IN PROGRESS!!!

Инструктивная версия адаптированной на русский язык модели Qwen2.5-7B. В модели был заменен токенизатор, затем произведено дообучение (Continued pretraining) на русскоязычном корпусе, после чего была применена техника LEP (Learned Embedding Propagation, paper will be soon).

Read the full model card

Благодаря новому токенизатору (расширенный tiktoken cl100k с помощью униграм токенизатора на 48 т. токенов) скорость генерации* русскоязычных текстов возрасла до 60% по сравнению с исходной моделью Qwen-2.5-7B-Instruct.

*Под скоростью генерации подразумевается количество русскоязычных символов/слов в секунду на одинаковых текстовых последовательностях.

Токенизация

Метрики и оценка качества

Модель была оценена на Ru-Arena-General, MERA, llmtf_open

Результаты на Ru-Arena-General

Замеры были произведены с использованием оффициального кода лидерборда (https://github.com/VikhrModels/ru_llm_arena), но с repetition_penalty=1.1.

Приведена лишь часть лидерборда, подробнее смотрите в репозитории бенчмарка (https://huggingface.co/spaces/Vikhrmodels/arenahardlb).

Model NameWinrate95% CIAverage # Tokens
gpt-4-1106-preview90.9( +1.3 / -0.9)541
vikhr-nemo-12b-instruct-r-21-09-2487.3(+1.1 / -1.2)627
gpt-4o-mini83.9(+1.9 / -1.6)448
ruadapt_qwen2.5_7B_ext_u48_instruct81.9(+1.7 / -1.6)556
gemma-2-9b-it76.5(+1.1 / -1.1)459
Qwen2.5-7B-Instruct76.0(+1.6 / -1.8)484
gemma-2-9b-it-sppo-iter373.6(+2.1 / -2.2)509
saiga_llama3_8b_v767.6(+1.7 / -1.4)503
ruadapt_qwen2.5_3B_ext_u48_instruct_v466.1(+2.2 / -1.9)531
t-lite-instruct-0.164.7(+2.3 / -2.2)810
Результаты на MERA

TODO

Результаты на llmtf_open

TODO

How to cite:

Tikhomirov M., Chernyshev D. Facilitating large language model Russian adaptation with Learned Embedding Propagation // 2024 (Preprint: https://arxiv.org/abs/2412.21140)

Tikhomirov M., Chernyshev D. Impact of Tokenization on LLaMa Russian Adaptation //2023 Ivannikov Ispras Open Conference (ISPRAS). – IEEE, 2023. – С. 163-168.

Предупреждение

Ответы модели не отражают мнения авторов, а лишь повторяют знания полученные из данных на всех этапах обучения (предобучение, смена токенизатора, обучение на инструкциях, калибровка качества ответов). Модель была получена из сторонней предобученной модели, контроль за предобучением которой не является ответственностью текущих авторов. При создании данной версии модели не производилось никаких дополнительных действий, направленных на изменение заложенных в LLM "мнений". Используйте с осторожностью.

From the published model card. Full card on the HuggingFace links in the sidebar.

Using it via the API

Call it like any OpenAI endpoint

Once AxForge deploys ruadapt-qwen2-5-7b-ext-u48 for you, it answers on the OpenAI-compatible API — the same base URL and keys as every other model. (ruadapt-qwen2-5-7b-ext-u48 below is illustrative; you get the exact model name on deployment.)

$ curl -sS https://api.axforge.ai/v1/chat/completions \
  -H "Authorization: Bearer $AXFORGE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"ruadapt-qwen2-5-7b-ext-u48","messages":[{"role":"user","content":"Hello"}]}'

Create an account — your API key is available in the console. 3M free tokens every 30 days with every new account.

© 2026 AxForge · EU-hosted AI infrastructure Pricing Docs Trust Privacy Terms