Minimax

MiniMax-M3

MiniMaxBasé sur les jetonsTarification dynamique

MiniMax 的 MiniMax-M3 模型,支持文本、图像、视频输入和文本输出。支持推理、工具调用、结构化输出。

textimagevideofunction_callingtoolsjson_modestructured_outputreasoningvisioncontext:1048576
Tarif à partir de
Voir tous les tarifs
Contexte
1M
Fenêtre d'entrée maximale
Sortie max
512K
Nombre maximal de jetons par réponse
Modalités
→
Sorti
Jun 2026

Tarification par fournisseur

official
-40%
官方接口直连
standard
Entree$0.3$0.18/ 1M
Sortie$2.1$1.26/ 1M
Lecture du cache$0.06$0.036/ 1M
long_context
Entree$0.6$0.36/ 1M
Sortie$2.4$1.44/ 1M
Lecture du cache$0.12$0.072/ 1M
Alibaba
阿里巴巴百炼官方
standard
Entree$0.3/ 1M
Sortie$2.1/ 1M
Lecture du cache$0.06/ 1M
long_context
Entree$0.6/ 1M
Sortie$2.4/ 1M
Lecture du cache$0.12/ 1M

Capacités / Modalités prises en charge

Appel de fonctionOutilsMode JSONSortie structuréeRaisonnementVision
Entree
Sortie

Fournisseur & confidentialité

Fournisseur
MiniMaxDocuments
Tokeniseur
ABAB tokenizer
Licence
Proprietary (commercial)Propriétaire
Rétention des données67 joursNon utilisé pour l'entraînement amont par défaut

Performances

À propos de MiniMax-M3

MiniMax 的 MiniMax-M3 模型,支持文本、图像、视频输入和文本输出。支持推理、工具调用、结构化输出。

Cas d’usage et prompts

Pistes pour commencer l’évaluation ; les entrées et options prises en charge figurent dans la section d’accès API.

Cas d’usage à explorer

  • Rédigez et révisez des textes avec un public, un ton et un format clairement définis.
  • Résumez les documents fournis et comparez les réponses aux sources originales.

Conseils pratiques

Séparez les instructions des sources, décrivez le résultat attendu et fournissez un exemple. Testez les outils ou les sorties structurées uniquement si leur prise en charge est indiquée.

Exemple de prompt

Résumez le document suivant en cinq points. Séparez les faits confirmés des questions ouvertes, citez les passages pertinents et n’inventez pas les informations manquantes. Document : [collez votre texte]

Accès API

Exemples de code

RequêtePOST/v1/chat/completions
Exemple de requête
Paramètres
ParamètreTypeDéfaut / plageDescription
temperature
number
=10 ~ 2
Température d'échantillonnage ; plus c'est bas, plus c'est déterministe
top_p
number
=10 ~ 1
Masse probabiliste de l'échantillonnage nucleus
max_tokens
integer>= 1Nombre maximum de jetons dans la réponse
frequency_penalty
number
=0-2 ~ 2
Pénalise la répétition des jetons fréquents
presence_penalty
number
=0-2 ~ 2
Encourage l'introduction de nouveaux sujets
stop
array—Jusqu'à 4 chaînes qui arrêtent la génération
seed
integer—Graine d'échantillonnage déterministe (meilleur effort)
n
integer
=1>= 1
Nombre de complétions à générer
stream
boolean
=false
Diffuser les jetons via Server-Sent Events
response_format
object—Forcer une sortie JSON ou conforme à un schéma
tools
array—Déclarations d'outils / fonctions que le modèle peut appeler
tool_choice
string
autononerequired
Stratégie de choix d'outil ou nom d'outil spécifique
logprobs
boolean
=false
Retourner les log-probabilités par jeton
top_logprobs
integer0 ~ 20Nombre de log-probabilités retournées par jeton
logit_bias
object—Carte de biais des logits par jeton
user
string—Identifiant d'utilisateur final pour la surveillance des abus

Remplacer <YOUR_API_KEY> par la clé API de votre page de jetons.

Authentification

Toutes les requêtes doivent inclure Authorization: Bearer <TOKEN> . Les points de terminaison au format Anthropic acceptent à la place x-api-key .

Générez des jetons depuis la page Jetons ; vous pouvez les restreindre par modèle, groupe, IP et limites de débit.

Paramètres pris en charge

Generation parameters
ParamètreTypeDéfaut / plageDescription
temperature
number
=10 ~ 2
Température d'échantillonnage ; plus c'est bas, plus c'est déterministe
top_p
number
=10 ~ 1
Masse probabiliste de l'échantillonnage nucleus
max_tokens
integer>= 1Nombre maximum de jetons dans la réponse
frequency_penalty
number
=0-2 ~ 2
Pénalise la répétition des jetons fréquents
presence_penalty
number
=0-2 ~ 2
Encourage l'introduction de nouveaux sujets
stop
array—Jusqu'à 4 chaînes qui arrêtent la génération
seed
integer—Graine d'échantillonnage déterministe (meilleur effort)
n
integer
=1>= 1
Nombre de complétions à générer
stream
boolean
=false
Diffuser les jetons via Server-Sent Events
response_format
object—Forcer une sortie JSON ou conforme à un schéma
tools
array—Déclarations d'outils / fonctions que le modèle peut appeler
tool_choice
string
autononerequired
Stratégie de choix d'outil ou nom d'outil spécifique
logprobs
boolean
=false
Retourner les log-probabilités par jeton
top_logprobs
integer0 ~ 20Nombre de log-probabilités retournées par jeton
logit_bias
object—Carte de biais des logits par jeton
user
string—Identifiant d'utilisateur final pour la surveillance des abus

Limites de débit

FournisseurRPMTPMRPD
Alibaba440177K8.9K
official680274K14K

RPM = requêtes/minute, TPM = jetons/minute, RPD = requêtes/jour. Les limites s'appliquent par groupe de jetons.

Questions fréquentes sur MiniMax-M3

Qu’est-ce que MiniMax-M3 ?

MiniMax 的 MiniMax-M3 模型,支持文本、图像、视频输入和文本输出。支持推理、工具调用、结构化输出。

Comment appeler MiniMax-M3 ?

Créez une clé API autorisée à utiliser MiniMax-M3, puis utilisez l’identifiant exact et un point de terminaison pris en charge dans la section d’accès API. Les champs dépendent du point de terminaison choisi.

Comment MiniMax-M3 est-il facturé ?

Le tarif dépend du groupe de fournisseurs choisi et de l’unité de facturation du modèle. Les prix actuels d’entrée, de sortie, par requête ou par média sont affichés sur cette page avant l’inscription.

Quelle est la fenêtre de contexte de MiniMax-M3 ?

Le catalogue indique une fenêtre de contexte de 1048576 tokens. Vérifiez les limites du point de terminaison sélectionné.

Quelle est la sortie maximale de MiniMax-M3 ?

Le catalogue indique une sortie maximale de 512000 tokens. Vos paramètres peuvent définir une limite inférieure.

Comment évaluer MiniMax-M3 pour mon projet ?

Séparez les instructions des sources, décrivez le résultat attendu et fournissez un exemple. Testez les outils ou les sorties structurées uniquement si leur prise en charge est indiquée.