FAQ
Questions fréquentes
Les questions qu’on nous pose réellement, traitées à la longueur qu’elles méritent plutôt qu’en une phrase. Regroupées pour que vous trouviez la vôtre sans lire tout le reste.
Si quelque chose n’est pas couvert ici, joignez-le à votre demande et nous y répondrons directement plutôt que de vous renvoyer à cette page.
01
Pour commencer
À quoi ressemble une première mission.
Par un pilote cadré. Vous envoyez un échantillon de données représentatif et une description de ce que le modèle doit faire ; nous rédigeons les décisions de consignes que la tâche exigera, annotons un petit lot et restituons l’accord mesuré sur celui-ci. Le pilote existe pour découvrir où deux annotateurs raisonnables divergent, car c’est là que votre spécification est incomplète. Le dimensionnement et la tarification de la production découlent de ce que le pilote mesure, et non d’une estimation.
Un échantillon de données, la description de la tâche, le format de sortie qu’il vous faut, et toute contrainte — délai, exigences de confidentialité, outillage dans lequel vous voulez que nous travaillions. Un devis produit à partir d’une seule description de tâche est une supposition ; nous préférons passer une heure sur de vraies données plutôt que de produire un chiffre qui changera après le premier lot.
Généralement une à trois semaines à compter de la réception des données, selon l’ampleur du travail de spécification que la tâche demande. L’essentiel de ce temps est consacré à la rédaction des consignes et au calibrage, non à l’annotation. Une tâche dotée de consignes existantes et éprouvées avance nettement plus vite.
Aucun minimum fixe. Nous menons de petits pilotes comme des programmes de production à fort volume. Ce qui fixe un plancher pratique, c’est le coût de mise en place — le travail sur les consignes, l’outillage et le calibrage sont largement fixes quel que soit le volume, si bien qu’une toute petite mission ponctuelle en supporte une part disproportionnée. Nous vous le dirons le cas échéant plutôt que de le noyer dans le devis.
À l’unité de travail — à l’item, à l’heure d’audio, à l’image, à l’évaluation — le tarif dépendant de la complexité de la tâche, de la profondeur de relecture et du niveau d’expertise requis. L’élaboration des consignes et le calibrage sont chiffrés à part, car ce sont de vrais travaux qui ont lieu avant l’étiquetage du moindre item. Nous ne facturons pas les échanges de cadrage du pilote.
02
Prestations et périmètre
Ce que nous faisons, et là où nous ne sommes pas le bon interlocuteur.
Le japonais est notre raison d’être. Nous prenons en charge les travaux bilingues japonais–anglais — relecture de traduction, alignement interlingue, jeux d’évaluation parallèles — parce qu’ils mobilisent le même jugement en japonais. Pour des travaux en volume dans d’autres langues, nous préférons vous dire franchement que nous ne sommes pas le bon prestataire plutôt que de prendre le projet et de le sous-traiter.
Oui. Nous travaillons dans les plateformes et bureaux virtuels fournis par le client, y compris lorsque la politique exige que les données ne quittent jamais votre infrastructure, et dans notre propre environnement sécurisé lorsque vous préférez ne pas créer de comptes. L’outillage change ; les consignes, les passes de relecture et la restitution QA, non.
Nous collectons et créons des données lorsqu’il s’agit d’un travail en langue japonaise — rédaction de données d’instruction, construction de prompts d’évaluation, enregistrement de parole scriptée, recherche d’échantillons documentaires. Nous ne sommes pas une structure de collecte de données généraliste, et pour une collecte de terrain à grande échelle, un spécialiste vous servirait mieux.
Oui, et la première chose que nous faisons est de lire ses consignes et de réannoter à l’aveugle un échantillon des données déjà livrées. Cela vous dit ce que vous avez réellement — y compris si les étiquettes existantes sont cohérentes entre elles — avant d’y ajouter quoi que ce soit. Poursuivre un jeu de données sans mesurer ce qu’il contient est la façon dont l’incohérence se cumule.
Oui. Une équipe dédiée est un dispositif courant pour les programmes d’IA au long cours, où les mêmes annotateurs portent les consignes dans la durée et où leur contexte accumulé est un actif réel. C’est aussi le dispositif où la dérive des consignes compte le plus, il s’accompagne donc d’un recalibrage périodique sur un jeu de référence.
03
Langue japonaise
Ce que signifie la couverture du japonais en pratique.
Les registres formels et informels à travers les kanji, hiragana, katakana et l’écriture latine, y compris le langage honorifique, la variation régionale, l’argot, le jargon sectoriel et l’écriture technique mêlant japonais et anglais. Les règles de normalisation pour le choix d’écriture, les chiffres, la ponctuation, les émojis et les caractères pleine chasse sont convenues au lancement, car ces choix déterminent la cohérence interne du corpus.
Oui. Cela compte pour les jugements qui dépendent de la façon dont une phrase est reçue plutôt que de ce qu’elle dénote — un refus se lit-il comme un refus, un niveau de politesse convient-il à la relation, une tournure sonne-t-elle traduite. Pour des tâches mécaniques encadrées par des consignes serrées, cette exigence est moins critique, et nous constituons les équipes en conséquence plutôt que de facturer une expertise dont la tâche n’a pas besoin.
Oui, avec la réserve que la couverture dialectale est une question de recrutement et que nous serons précis sur les variétés que nous pouvons couvrir de façon fiable. La décision la plus importante est en amont : le dialecte est-il transcrit tel qu’il est prononcé ou normalisé en japonais standard ? Ce choix change entièrement le jeu de données et doit être fait délibérément.
Par une convention de normalisation écrite, appliquée au moment de l’annotation et vérifiée par des contrôles automatiques avant livraison. Elle couvre le choix d’écriture pour les mots fréquents, l’orthographe des voyelles longues en katakana, le recours aux chiffres arabes ou aux kanji, les caractères pleine et demi-chasse, les espaces autour du texte latin et la ponctuation. La variation orthographique est le défaut le plus fréquent des jeux de données japonais non spécifiés, et le plus facile à prévenir.
Oui, et nous préférons adopter le vôtre plutôt qu’imposer le nôtre — un modèle qui écrit déjà dans votre style maison devrait continuer. Ce que nous ferons, c’est l’éprouver sur de vrais cas limites pendant le pilote, car la plupart des guides de style comportent deux ou trois règles qui se révèlent contradictoires au contact des données réelles.
04
Qualité et livraison
Comment la qualité est mesurée et ce que vous recevez.
L’accord inter-annotateurs avec un coefficient corrigé du hasard, l’exactitude sur jeu de référence, le taux d’arbitrage, et des décomptes d’erreurs ventilés selon une taxonomie nommée plutôt qu’un total de défauts unique. Tout est restitué par étiquette ou par critère plutôt que globalement, car un chiffre global masque précisément la catégorie qui échoue. La page qualité expose comment chaque chiffre est calculé et ce qu’il ne capte pas.
JSONL, CSV, CoNLL-U, COCO, SRT, CTM, TextGrid, hOCR et des schémas sur mesure définis au lancement. Les données par empans incluent toujours les décalages en caractères sous le format d’étiquetage retenu, de sorte qu’un changement ultérieur de tokeniseur soit une réexportation et non une réannotation. Chaque lot est livré avec sa version de consignes et un journal des modifications par rapport au précédent.
Les révisions suivent le même parcours de relecture et d’arbitrage que le premier passage — une voie rapide de correction est précisément ce qui fait dériver un jeu de données d’un lot à l’autre. Lorsque la cause est une lacune des consignes, nous révisons les consignes et reprenons les items concernés, pas seulement ceux que vous avez signalés, car la même lacune aura produit la même erreur ailleurs.
Le débit dépend de la complexité de la tâche, de la profondeur de relecture et de la part d’ambiguïté réelle que contiennent les données, et il varie davantage d’une tâche à l’autre que la plupart des estimations ne l’admettent. Nous mesurons le débit réel pendant le pilote sur vos données et nous engageons sur un plan à partir de là. Une date de livraison annoncée avant que quiconque ait annoté vos données est une supposition présentée comme un engagement.
Nous examinons les items concernés avec vous. En général, l’une de ces trois choses est vraie : les consignes étaient ambiguës, auquel cas nous les révisons et reprenons le travail ; les consignes étaient claires et mal appliquées, auquel cas nous corrigeons et réinjectons cela en relecture ; ou les consignes disent quelque chose que vous ne voulez plus qu’elles disent, auquel cas le changement relève d’une décision de périmètre. Ranger un désaccord dans l’une de ces trois cases est plus productif que de discuter de l’étiquette elle-même.
05
Sécurité, juridique et commercial
Confidentialité, contrats et travail avec vos achats.
Un NDA avant tout partage, un accord de traitement des données dès qu’il y a des informations personnelles, un accès par rôle limité aux personnes affectées au projet, un environnement de travail isolé, et des durées de conservation et modalités de suppression inscrites au contrat plutôt que laissées à une politique interne. La page sécurité détaille chaque contrôle et, tout aussi important, ce que nous ne revendiquons pas.
Nous ne revendiquons aucune certification qui ne soit inscrite dans notre contrat avec vous. Interrogez-nous sur un référentiel précis et vous obtiendrez une réponse directe, y compris lorsque cette réponse est non. Nous préférons perdre un appel d’offres pour avoir été exacts que le remporter sur une affirmation qui ne survivra pas à un audit.
À vous. Les livrables et les annotations dérivées vous appartiennent en vertu du contrat de mission. Nous ne conservons pas les données client pour une réutilisation interne, pour entraîner des modèles ni à titre de portfolio, et tout exemple présenté sur ce site est le nôtre, créé à titre d’illustration.
Oui, c’est la norme pour les missions grands comptes. Lorsqu’une clause nous engage sur quelque chose que nous ne pouvons pas réellement tenir — un chiffre d’exactitude précis, une certification que nous ne détenons pas — nous le disons et proposons une autre rédaction plutôt que de signer en espérant. C’est une conversation plus lente, et plus courte que l’alternative.
Lorsqu’il y a sous-traitance, elle est déclarée, et elle est couverte par les mêmes obligations de confidentialité que celles qui lient notre propre personnel. Elle n’est jamais supposée en silence. Si votre politique interdit totalement la sous-traitance, dites-le-nous et nous confirmerons si nous pouvons constituer l’équipe sur cette base avant que vous ne vous engagiez.
06
Annotation experte
Les spécialistes métier, et les limites de ce que nous affirmons.
Pour les projets qui l’exigent, nous constituons des équipes autour de l’expertise métier requise, ce qui peut inclure des personnes disposant de qualifications pertinentes ou d’une expérience pratique dans des domaines tels que le droit, la fiscalité, la comptabilité, le droit social et la protection sociale, ou l’immatriculation des sociétés. Nous n’entretenons pas de vivier permanent de professionnels agréés. La disponibilité est appréciée projet par projet au regard du périmètre, du volume, de la spécialisation et du calendrier, et si une qualification ne peut pas être trouvée pour votre projet, nous vous le dirons avant son démarrage.
D’après la nature du jugement qu’exige la tâche. La terminologie et les conventions documentaires peuvent être transmises à un annotateur formé avec un bon lexique et une phase de calibrage, et pour la plupart des travaux c’est la meilleure réponse — plus rapide, plus cohérente et moins coûteuse. Un spécialiste se justifie lorsque le jugement lui-même est professionnel : savoir si une interprétation est défendable, si une réponse induirait un lecteur en erreur sur ses obligations.
Oui. Des spécialistes métier peuvent noter les réponses générées sur l’exactitude factuelle, la qualité du raisonnement, la justesse professionnelle et le respect de vos critères, et produire des classements de préférences pour les travaux d’alignement, des jeux de benchmark, l’évaluation de la recherche documentaire et du red teaming. Le raisonnement derrière chaque jugement est consigné, ce qui est généralement ce qui rend une évaluation experte digne de son coût.
Non. Ils annotent et évaluent des données. Le résultat est constitué de données d’entraînement ou d’évaluation pour votre système d’IA, et non d’un conseil juridique, fiscal ou comptable à vous ou à vos utilisateurs, et rien de ce qui est produit dans un projet d’annotation ne doit être présenté à un utilisateur final comme un conseil professionnel. Nous sommes explicites là-dessus parce que la distinction compte pour nous deux.
Une autre question ?
Posez-la directement.
Joignez-la à votre demande et vous obtiendrez une réponse précise de quelqu’un qui a mené le type de projet que vous décrivez — pas un lien renvoyant à cette page.
Nous répondons sous un jour ouvré.