Tencent: Hy-MT2-30B-A3B

Чат с моделью
"model":"tencent/hy-mt2-30b-a3b"
Контекст
8K токенов
Вход
Текст
Выход
Текст

Hy-MT2-30B-A3B — флагманская модель перевода Tencent в семействе Hy-MT2. Она поддерживает 33 языковые пары и пять пар с китайскими диалектами и языками национальных меньшинств, а также сценарии структурированного перевода, перевода с разделителями, контекстного перевода, перевода с глоссарием и перевода с заданным стилем. Модель использует 3 млрд активных параметров из 30 млрд.

ЦенаЗа 1M токенов
Вход9,35 ₽
Выход37,27 ₽

Поддерживаемые параметры

max_completion_tokensЛимит ответа

Максимальное число токенов в ответе модели — вариант названия, принятый в новых версиях API OpenAI (включая токены рассуждений у reasoning-моделей). Ограничивает только длину генерации, а не весь контекст. Слишком маленькое значение приводит к обрыву ответа, слишком большое — к лишним расходам. Функционально аналогичен max_tokens.

max_tokensЛимит ответа

Ограничивает максимальное число токенов, которое модель сгенерирует в ответе. Это потолок длины именно ответа, не считая токенов запроса; сумма запроса и ответа не может превышать размер контекстного окна. Если лимит мал, ответ может оборваться на середине. Параметр также влияет на стоимость, так как выходные токены тарифицируются отдельно.

response_formatФормат ответа

Задаёт требуемый формат вывода модели. В режиме JSON-объекта модель обязана вернуть синтаксически корректный JSON, что удобно для программной обработки. Можно также потребовать соответствие конкретной JSON-схеме. Использование этого параметра снижает необходимость «вычищать» свободный текст и парсить его эвристиками.

stopСтоп-последовательности

Список строк, при появлении которых генерация немедленно останавливается. Сами стоп-строки в ответ не включаются, что удобно для обрезания вывода по разделителю или маркеру конца. Часто используется в структурированных промптах и при ролевой разметке диалога. Можно задать несколько последовательностей одновременно.

structured_outputsСтруктурированный вывод

Гарантирует, что ответ модели строго соответствует заданной JSON-схеме. В отличие от обычной просьбы «верни JSON», провайдер на уровне декодирования не позволяет нарушить структуру и типы полей. Это критично для надёжных интеграций, где ответ сразу передаётся в код без дополнительной валидации. Поддерживается не всеми моделями и обычно используется вместе с описанием схемы.

temperatureТемпература

Управляет случайностью выбора следующего токена. Значение около 0 делает ответы почти детерминированными и предсказуемыми — модель каждый раз выбирает наиболее вероятное продолжение. Более высокие значения (0.7–1.0 и выше) повышают разнообразие и «креативность», но и риск ошибок и бессвязности. Для фактических задач и кода обычно берут низкую температуру, для генерации идей и текстов — выше.

Быстрый старт

curl https://api.aiadapter.ru/api/v1/chat/completions \
  -H "Authorization: Bearer sk-aa-v1-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"tencent/hy-mt2-30b-a3b","messages":[{"role":"user","content":"Привет!"}]}'