Ajouter ou remplacer des entrées de dataset
Écrit jusqu’à 5,000 lignes de chat OpenAI en une seule transaction. Envoyez un tableau JSON ou les mêmes lignes au format NDJSON (une ligne de données par ligne de texte) avec Content-Type: application/x-ndjson. Toute ligne invalide entraîne le rejet de la requête et est signalée par son index ; la ligne N du fichier NDJSON correspond à l’index N - 1. mode=append rejette un row_id qui existe déjà (409 entry_exists) ; mode=upsert remplace la ligne en conservant les valeurs stockées de group_id, split, metadata et provenance pour les champs qu’elle omet. Les nouvelles entrées sont affectées par défaut à train et à leur propre groupe. Une écriture qui placerait un groupe dans plusieurs partitions renvoie 409 group_split_conflict. L’écriture crée une nouvelle révision du dataset et marque les réétiquetages et évaluations terminés comme obsolètes.
Autorisations
Une clé API wandb ou un JWT wandb. Les sessions du navigateur sont échangées par le backend de l’application web Model Distillation ; les capacités des tâches sont réservées à un usage interne.
En-têtes
entity personnel ou d’équipe accessible. Omettez ce champ pour utiliser l’entity par défaut de l’utilisateur authentifié.
Paramètres de requête
append rejette les lignes dont le row_id existe déjà ; upsert les remplace.
append, upsert Validez la modification et indiquez son résultat, puis annulez-la.
Corps
1 - 5000 elements2 - 1000 elementsIdentité stable au sein du dataset, utilisée par les opérations upsert pour retrouver les entrées correspondantes. Par défaut, une empreinte des messages et des champs de la requête.
1 - 512Lignes qui doivent appartenir à la même partition, comme les tours d'une même conversation. Par défaut, row_id.
1 - 512train, ou val pour exclure la ligne de l'entraînement et la réserver à l'évaluation. Les nouvelles lignes sont affectées par défaut à train.
train, val 128Attributs utilisables pour le filtrage, comme l'utilisateur ou le segment de clientèle.
Origine de la ligne, comme le système source et l'identifiant de trace.
Réponse
Les entrées ont été écrites, ou le seraient dans le cadre d'une simulation à blanc.
Lignes devenues de nouvelles entrées.
Entrées existantes remplacées par les lignes.
La révision du dataset après l’écriture ; inchangée lors d’une simulation à blanc.
Groupes présents dans plusieurs partitions. Une écriture réelle comportant des conflits est rejetée.