Modèles
Qwen 3.8 Flash
Identifiant du modèle: alibaba_qwen/qwen3.8-flash
- Économique
- Rapide
- Code
- Raisonnement
- Vision
- Multimodal
- Long contexte
- Outils
Qwen 3.8 Flash : le frère moins cher et plus rapide de Qwen 3.8 Max, avec raisonnement hybride et longue fenêtre.
Idéal pour
beaucoup de clavardage et d’agents Qwen quand Max est trop pour le besoin.
- Fournisseur
- Alibaba Cloud Model Studio
- Fenêtre de contexte
- 1 000 000
- Date de sortie
- 2026-08-26
- Effort de raisonnement
- nonelowmediumhighPar défaut : none
Tarif
Requête
0,2313 $ / 1 M
Réponse
0,7249 $ / 1 M
Montants en dollars canadiens, convertis au taux indicatif de la Banque du Canada (2026-09-21).
Performance
Mesure
7 derniers jours
Pas assez de données pour afficher le graphique.
Activité
Jetons
—
—
—
—
—
Top 5 des outils · 7 derniers jours
Pas assez de données pour afficher l’activité par outil.
Disponibilité
Disponibilité (%)
7 derniers jours
- Sondes opérationnelles
- 99,89 % sur 7 jours
- Échantillons
- 9 204
Démarrage rapide
Appelez l'API avec une clé tonia_ et l'identifiant exact ci-dessous.
curl
curl https://pass.tonia.ca:8443/v1/chat/completions \
-H "Authorization: Bearer $TONIA_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "alibaba_qwen/qwen3.8-flash",
"messages": [
{
"role": "user",
"content": "Bonjour"
}
]
}'Python (OpenAI SDK)
import os
from openai import OpenAI
client = OpenAI(
base_url="https://pass.tonia.ca:8443/v1",
api_key=os.environ["TONIA_API_KEY"],
)
response = client.chat.completions.create(
model="alibaba_qwen/qwen3.8-flash",
messages=[{"role": "user", "content": "Bonjour"}],
)TypeScript (OpenAI SDK)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://pass.tonia.ca:8443/v1",
apiKey: process.env.TONIA_API_KEY,
});
const response = await client.chat.completions.create({
model: "alibaba_qwen/qwen3.8-flash",
messages: [{ role: "user", content: "Bonjour" }],
});