BaiLian

qwen3.5-omni-flash-realtime

AlibabaBasé sur les jetons

千问实时音视频对话模型,可理解文本、图像和音视频输入,并流式输出文本与语音。

textimageaudiovideostreaming
Tarif à partir de
Entree / Sortie · 1M
Contexte
—
Fenêtre d'entrée maximale
Modalités
→

Tarification par fournisseur

official
官方接口直连
Entree$75/ 1M
Sortie$75/ 1M
Alibaba
阿里巴巴百炼官方
Entree$82.5/ 1M
Sortie$82.5/ 1M

Capacités / Modalités prises en charge

Streaming
Entree
Sortie

Fournisseur & confidentialité

Fournisseur
Alibaba (Qwen)Documents
Tokeniseur
Qwen tokenizer (tiktoken-compat)
Licence
Tongyi Qianwen LicensePoids ouverts
Rétention des données63 joursNon utilisé pour l'entraînement amont par défaut

Performances

À propos de qwen3.5-omni-flash-realtime

千问实时音视频对话模型,可理解文本、图像和音视频输入,并流式输出文本与语音。

Cas d’usage et prompts

Pistes pour commencer l’évaluation ; les entrées et options prises en charge figurent dans la section d’accès API.

Cas d’usage à explorer

  • Évaluez les traitements vocaux ou audio avec des enregistrements ou des textes représentatifs.
  • Comparez l’intelligibilité, la prononciation et la gestion du bruit pour votre langue cible.

Conseils pratiques

Vérifiez d’abord la fonction du point de terminaison : entrée audio, transcription ou sortie audio. Confirmez les langues, formats et limites de longueur avant un traitement par lot.

Accès API

Exemples de code

RequêtePOST/v1/chat/completions
Exemple de requête
Paramètres
ParamètreTypeDéfaut / plageDescription
temperature
number
=10 ~ 2
Température d'échantillonnage ; plus c'est bas, plus c'est déterministe
top_p
number
=10 ~ 1
Masse probabiliste de l'échantillonnage nucleus
max_tokens
integer>= 1Nombre maximum de jetons dans la réponse
frequency_penalty
number
=0-2 ~ 2
Pénalise la répétition des jetons fréquents
presence_penalty
number
=0-2 ~ 2
Encourage l'introduction de nouveaux sujets
stop
array—Jusqu'à 4 chaînes qui arrêtent la génération
seed
integer—Graine d'échantillonnage déterministe (meilleur effort)
n
integer
=1>= 1
Nombre de complétions à générer
stream
boolean
=false
Diffuser les jetons via Server-Sent Events
response_format
object—Forcer une sortie JSON ou conforme à un schéma
tools
array—Déclarations d'outils / fonctions que le modèle peut appeler
tool_choice
string
autononerequired
Stratégie de choix d'outil ou nom d'outil spécifique
logprobs
boolean
=false
Retourner les log-probabilités par jeton
top_logprobs
integer0 ~ 20Nombre de log-probabilités retournées par jeton
logit_bias
object—Carte de biais des logits par jeton
user
string—Identifiant d'utilisateur final pour la surveillance des abus

Remplacer <YOUR_API_KEY> par la clé API de votre page de jetons.

Authentification

Toutes les requêtes doivent inclure Authorization: Bearer <TOKEN> . Les points de terminaison au format Anthropic acceptent à la place x-api-key .

Générez des jetons depuis la page Jetons ; vous pouvez les restreindre par modèle, groupe, IP et limites de débit.

Paramètres pris en charge

Generation parameters
ParamètreTypeDéfaut / plageDescription
temperature
number
=10 ~ 2
Température d'échantillonnage ; plus c'est bas, plus c'est déterministe
top_p
number
=10 ~ 1
Masse probabiliste de l'échantillonnage nucleus
max_tokens
integer>= 1Nombre maximum de jetons dans la réponse
frequency_penalty
number
=0-2 ~ 2
Pénalise la répétition des jetons fréquents
presence_penalty
number
=0-2 ~ 2
Encourage l'introduction de nouveaux sujets
stop
array—Jusqu'à 4 chaînes qui arrêtent la génération
seed
integer—Graine d'échantillonnage déterministe (meilleur effort)
n
integer
=1>= 1
Nombre de complétions à générer
stream
boolean
=false
Diffuser les jetons via Server-Sent Events
response_format
object—Forcer une sortie JSON ou conforme à un schéma
tools
array—Déclarations d'outils / fonctions que le modèle peut appeler
tool_choice
string
autononerequired
Stratégie de choix d'outil ou nom d'outil spécifique
logprobs
boolean
=false
Retourner les log-probabilités par jeton
top_logprobs
integer0 ~ 20Nombre de log-probabilités retournées par jeton
logit_bias
object—Carte de biais des logits par jeton
user
string—Identifiant d'utilisateur final pour la surveillance des abus

Limites de débit

FournisseurRPMTPMRPD
Alibaba620248K12K
official630252K13K

RPM = requêtes/minute, TPM = jetons/minute, RPD = requêtes/jour. Les limites s'appliquent par groupe de jetons.

Questions fréquentes sur qwen3.5-omni-flash-realtime

Qu’est-ce que qwen3.5-omni-flash-realtime ?

千问实时音视频对话模型,可理解文本、图像和音视频输入,并流式输出文本与语音。

Comment appeler qwen3.5-omni-flash-realtime ?

Créez une clé API autorisée à utiliser qwen3.5-omni-flash-realtime, puis utilisez l’identifiant exact et un point de terminaison pris en charge dans la section d’accès API. Les champs dépendent du point de terminaison choisi.

Comment qwen3.5-omni-flash-realtime est-il facturé ?

Le tarif dépend du groupe de fournisseurs choisi et de l’unité de facturation du modèle. Les prix actuels d’entrée, de sortie, par requête ou par média sont affichés sur cette page avant l’inscription.

Comment évaluer qwen3.5-omni-flash-realtime pour mon projet ?

Vérifiez d’abord la fonction du point de terminaison : entrée audio, transcription ou sortie audio. Confirmez les langues, formats et limites de longueur avant un traitement par lot.