Toutes les langues, la même précision.
La qualité du rappel est identique que vos utilisateurs écrivent en 日本語, 中文, Español ou en anglais. Nous la mesurons comme une grille de 70 couples langue de stockage / langue de requête et nous publions le chiffre : 95,2 % de recall@5.
Un store contenant plusieurs langues est l’endroit où la récupération se dégrade sans que personne ne le voie : la même question obtient un score différent selon la langue dans laquelle le souvenir a été écrit. Nous traitons cela comme un défaut et non comme une limite, et le mesurons sur une grille complète de couples de langues.
Un seul store, trois langues à la fois
Vous ne choisissez pas une langue par store - mélangez-les librement. Ci-dessous, la mémoire d'un même utilisateur contient à la fois du japonais, de l'anglais et de l'espagnol, et chaque question retrouve le bon souvenir quelle que soit la langue. Il s'agit d'un échange réel avec l'API en production :
# one user, three languages stored together mem.add("彼女はコーヒーより紅茶が好き", user_id="alice") # Japanese mem.add("she works at a design studio in Brooklyn", user_id="alice") # English mem.add("A ella le encanta hacer senderismo los sábados", user_id="alice") # Spanish
"¿Qué bebe ella?" -> 彼女はコーヒーより紅茶が好き "what does she do on weekends?" -> A ella le encanta hacer senderismo los sábados "彼女の仕事は?" -> she works at a design studio in Brooklyn
Aucune étape de traduction, aucune détection de langue, aucune configuration par langue. Souvenirs et questions sont placés selon le sens, pas selon la langue - si le sens correspond, la langue n'a pas d'importance.
Pourquoi aucune langue ne doit l’emporter sur une autre
Une règle passe avant toute autre décision de réglage : la qualité du rappel ne doit pas dépendre de la langue dans laquelle un souvenir a été écrit. Elle est mesurée sur 70 couples de langues et appliquée en revue de code, et rien qui élève une langue au détriment d’une autre ne part en production.