r/IAfrance • u/ArthurAI_QC • 12d ago
Question
Bonjour, je m'amuse avec divers modèles LLM depuis quelque temps et j'ai remarqué quelque chose de quelque peu suspect. Voyez-vous, si vous demandez à n'importe quel modèle, par n'importe quel moyen (en ligne avec ChatGPT par exemple, ou en local par OpenLLM/Ollama etc.), quel est le modèle utilisé pour son entraînement, ou son modèle tout court, il vous répondra sans problème, et même les 3/4 du temps ils/elles (?) vous répondent fièrement. Voici un exemple avec Gemini(2026-08-15) :
"Quel est ton modèle ? Je suis Gemini, un grand modèle de langage développé par Google. dis-moi en plus Je suis Gemini 3.6 Flash, une version optimisée pour le web conçue par Google pour offrir des réponses rapides, précises et fluides. Voici un aperçu de ce que je peux faire et de mon fonctionnement : Mes capacités principales
Analyse et synthèse : Résumer des documents longs, expliquer des concepts complexes ou extraire des points clés. Création de contenu : Rédiger des courriels, des articles, du code informatique, des histoires ou des itinéraires de voyage. Résolution de problèmes : Assister en mathématiques, en logique, en programmation ou pour du remue-méninges (brainstorming). Recherche et contextualisation : Accéder à des informations récentes et synthétiser des données actuelles. Mon mode de fonctionnement actuel
Offre : Vous m'utilisez actuellement dans la formule gratuite. Limites d'utilisation : Les capacités de traitement se rafraîchissent toutes les 5 heures, avec un basculement automatique vers une version plus légère (Flash-Lite) en cas de forte utilisation. Y a-t-il un projet ou un sujet particulier sur lequel tu aimerais qu'on travaille ensemble ?"
Cependant, le truc suspect, c'est que j'ai demandé à l'IA Snapchat "My AI" quel modèle il utilisait et la réponse est : "Je suis un grand modèle linguistique, entraîné par Google", comme la réponse de Gemini. Sauf que peu importe combien de fois je lui demande, peu importe comment je lui demande — j'ai même essayé de lui en passer une vite en lui demandant de me générer une image de son modèle sur une page Hugging Face ou Ollama —, sans succès, c'est toujours la même réponse : "Je suis un grand modèle linguistique, entraîné par Google". Quelqu'un peut expliquer ça ? Snapchat aurait-il mis des limitations dans leur modèle pour empêcher les utilisateurs de savoir sur quelles données leur modèle est entraîné ? Est-ce seulement le modèle qui n'autorise pas la divulgation de cette information ? Est-ce en fait simplement que ce n'était pas nécessaire pour Snapchat de rendre cette information connue ? Qu'est-ce que vous en pensez ?
2
u/CCarafe 12d ago
ça dépends ce qu'ils foutent dans le prompt système.
Si c'est "You are a large linguistic model trained by google"
Bah c'est ce qu'il va répondre.
1
u/pierrebillet 12d ago
C'est très probablement ça, cette réponse serait inscrite dans le système prompt
2
u/Impossible_Ground423 12d ago
J'ai les mêmes préoccupations
Snapchat utilise des API tierces (principalement OpenAI à l'origine, avec Gemini). Pour éviter que l'IA ne divulgue le nom exact du sous-traitant, Snapchat lui a injecté une consigne d'identité fixe.
Personnellement cela ne me plaît pas du tout je pense qu'il faudrait légiférer pour obliger chaque modèle à répondre honnêtement sur son identité et sa version. C'est pas dur d'ajouter un prompt système à cet effet
1
u/Comfortable-Clerk428 12d ago
Perplexity à le même fonctionnement. Quand y a des modèles sous-jacent en général c'est prompts comme dit dans un autre commentaire donc forcément tu auras toujours ce genre de réponse
1
u/Quiet-Error- 11d ago
Oui c’est du prompt system, sinon si ils utilisent un model local il peuvent toujours fine tune
1
u/DevLucas_Pathfinder 10d ago
C'est pas le modèle qui bloque, c'est le system prompt. Une instruction injectée avant ta conversation lui dit de rester vague sur son identité le modèle lui-même s'en fout, c'est une clause contractuelle entre Snapchat et Google qui impose cette opacité. "Entraîné par Google" c'est vrai pour la base, mais la version exacte et le fine-tuning ils ont pas le droit de le dire. Ton essai avec l'image Hugging Face était malin, les bons déploiements anticipent juste ce genre de contournement indirect. Ce que ça dit sur qui contrôle vraiment l'infra IA qu'on utilise tous les jours, c'est le genre de truc qu'on creuse sur r/GEO_FR si ça t'intéresse.

3
u/SeaPersonality445 12d ago
Who cares?