Doubao Seed 2.0 Responses API - Référence API complète
- Appel des modèles de la série Doubao Seed 2.0 au format Responses API
- Stockage du contexte côté serveur : conversations multi-tours via
previous_response_id, sans avoir à transmettre manuellement l’historique des messages - Entrée multimodale : prend en charge les entrées mixtes texte + image + vidéo + fichier (PDF)
- Réflexion approfondie : prend en charge le mode chaîne de raisonnement thinking
- Appel d’outils : prend en charge le Function Calling, la recherche web, le traitement d’image, les outils MCP, les bases de connaissances privées et l’assistant Doubao
- Cache de contexte : prend en charge le mécanisme de cache caching pour réduire les coûts
- Sortie structurée : prend en charge les formats JSON Object / JSON Schema
- Gestion du contexte : prend en charge la stratégie context_management
- 💡 Envie de démarrer rapidement ? Consultez le guide de démarrage rapide
https://direct.evolink.ai, qui offre une meilleure prise en charge des modèles de texte et des connexions persistantes. https://api.evolink.ai est le point d’accès principal pour les services multimodaux et sert d’adresse de secours pour les modèles de texte.Autorisations
##Toutes les API nécessitent une authentification Bearer Token##
Obtenir une clé API :
Visitez la Page de gestion des clés API pour obtenir votre clé API
Ajouter à l'en-tête de requête :
Corps
Nom du modèle de conversation
doubao-seed-2.0-pro: version phare, capacités globales les plus élevéesdoubao-seed-2.0-lite: version allégée, plus rapidedoubao-seed-2.0-mini: version ultra-rapide, réponse la plus rapidedoubao-seed-2.0-code: version spécialisée pour le code
doubao-seed-2.0-pro, doubao-seed-2.0-lite, doubao-seed-2.0-mini, doubao-seed-2.0-code "doubao-seed-2.0-pro"
Contenu d'entrée. Deux formats sont pris en charge :
1. Chaîne de texte brut : équivalent à un texte saisi avec le rôle user
2. Liste d'éléments (array) : contient plusieurs types d'entrée, notamment messages, contexte et appels d'outils
Insère un message système ou une instruction développeur comme première instruction du contexte du modèle
Remarque :
- Lorsqu'il est utilisé avec previous_response_id, les instructions de la réponse précédente ne sont pas héritées
- Ne peut pas être utilisé conjointement avec la fonctionnalité de cache caching
Identifiant unique de la réponse précédente du modèle, utilisé pour les conversations multi-tours
Remarque :
- Lorsqu'il est fourni, l'entrée et la réponse du tour précédent sont reprises, et le nombre de tokens d'entrée de cette requête augmente en conséquence
- Dans les conversations multi-tours continues, il est recommandé d'ajouter environ 100 millisecondes de délai entre chaque requête
Date d'expiration du stockage, horodatage Unix UTC (secondes)
Remarque :
- Plage de valeurs : (date de création, date de création + 604800], soit une conservation maximale de 7 jours
- Valeur par défaut : date de création + 259200 (3 jours)
- S'applique à la fois à store et à caching
- La durée de stockage du cache est facturée ; toute tranche de moins de 1 heure est comptée comme 1 heure
Nombre maximal de tokens de sortie du modèle, incluant la réponse et la chaîne de raisonnement
32768
Contrôle si le modèle active le mode de réflexion approfondie
Limite l'effort de réflexion approfondie ; le réduire accélère la réponse et consomme moins de tokens
Indique s'il faut activer la mise en cache du contexte
Remarque : ne peut pas être utilisé conjointement avec le champ instructions ni avec le champ tools (hors Function Calling)
Indique s'il faut stocker la réponse générée par le modèle afin de la récupérer ultérieurement via l'API
true: stocker la réponse actuelle du modèlefalse: ne pas la stocker
Indique si le contenu de la réponse est renvoyé en streaming
false: le modèle renvoie tout le contenu en une seule fois, une fois la génération terminéetrue: renvoi progressif par blocs selon le protocole SSE, se terminant par un messagedata: [DONE]
Température d'échantillonnage, contrôle le caractère aléatoire de la sortie
- Plage de valeurs : [0, 2]
- Les valeurs basses donnent des sorties plus déterministes, les valeurs élevées plus aléatoires
- Il est recommandé de n'ajuster que temperature ou top_p
Remarque : doubao-seed-2.0-pro et doubao-seed-2.0-lite sont fixés à 1 ; toute valeur indiquée manuellement est ignorée
0 <= x <= 2Seuil de probabilité de l'échantillonnage nucleus
- Plage de valeurs : [0, 1]
- Il est recommandé de n'ajuster que temperature ou top_p
Remarque : doubao-seed-2.0-pro et doubao-seed-2.0-lite sont fixés à 0.95 ; toute valeur indiquée manuellement est ignorée
0 <= x <= 1Définition du format de sortie du texte du modèle
Liste des outils que le modèle peut appeler
Types d'outils pris en charge :
function: fonction personnalisée (Function Calling)web_search: recherche webdoubao_app: assistant Doubaoimage_process: traitement d'imagemcp: outils MCPknowledge_search: recherche dans une base de connaissances privée
Contrôle si le modèle appelle des outils
Mode chaîne :
none: ne pas appeler d'outilsrequired: doit appeler un outilauto: le modèle décide (par défaut)
Mode objet : indiquer un outil précis à appeler
none, auto, required Nombre maximal de tours d'appels d'outils (nombre d'appels illimité par tour)
- Plage de valeurs : [1, 10]
- Web Search : 3 par défaut
- Image Process : 10 par défaut (non modifiable)
- Knowledge Search : 3 par défaut
Remarque : ce paramètre fonctionne au mieux des possibilités ; le nombre réel d'appels dépend notamment de la qualité du raisonnement du modèle
1 <= x <= 10Stratégie de gestion du contexte, qui aide le modèle à exploiter efficacement la fenêtre de contexte
Réponse
Réponse générée avec succès
Identifiant unique de cette réponse
"resp_02177148667427813c33c36521378d02b2c8389204fa8c3e2f63e"
Type d'objet, valeur fixe response
response "response"
Horodatage Unix de création (secondes)
1771486674
Nom et version du modèle réellement utilisé
"doubao-seed-2-0-code-preview-260215"
Statut de la réponse
completed: génération terminéein_progress: génération en coursincomplete: incomplètefailed: échec
completed, in_progress, incomplete, failed "completed"
Liste des contenus de sortie du modèle : sortie de la chaîne de raisonnement, sortie de message, sortie d'appel d'outil, etc.
- Sortie de la chaîne de raisonnement
- Sortie de message
- Sortie de l'appel d'outil
Niveau de service de cette requête
default: niveau de service par défautscale: quota du forfait garanti utilisé
"default"
Instructions système utilisées pour cette requête
ID de la réponse précédente référencée
Nombre maximal de tokens de sortie du modèle
32768
Température d'échantillonnage utilisée
Valeur top_p utilisée
Configuration du mode de réflexion utilisée
Liste des outils utilisés
Configuration de sélection d'outils utilisée
Indique si les appels d'outils en parallèle sont autorisés
Configuration du format de sortie du texte
Statistiques d'utilisation des jetons
Configuration du cache
Indique si la réponse a été stockée
Date d'expiration du stockage (horodatage Unix)
1756539922
Informations d'erreur, null en cas de succès
Raison détaillée de l'inachèvement