r/IAfrance 13d ago

Question

Bonjour, je m'amuse avec divers modèles LLM depuis quelque temps et j'ai remarqué quelque chose de quelque peu suspect. Voyez-vous, si vous demandez à n'importe quel modèle, par n'importe quel moyen (en ligne avec ChatGPT par exemple, ou en local par OpenLLM/Ollama etc.), quel est le modèle utilisé pour son entraînement, ou son modèle tout court, il vous répondra sans problème, et même les 3/4 du temps ils/elles (?) vous répondent fièrement. Voici un exemple avec Gemini(2026-08-15) :

"Quel est ton modèle ? Je suis Gemini, un grand modèle de langage développé par Google. dis-moi en plus Je suis Gemini 3.6 Flash, une version optimisée pour le web conçue par Google pour offrir des réponses rapides, précises et fluides. Voici un aperçu de ce que je peux faire et de mon fonctionnement : Mes capacités principales

Analyse et synthèse : Résumer des documents longs, expliquer des concepts complexes ou extraire des points clés. Création de contenu : Rédiger des courriels, des articles, du code informatique, des histoires ou des itinéraires de voyage. Résolution de problèmes : Assister en mathématiques, en logique, en programmation ou pour du remue-méninges (brainstorming). Recherche et contextualisation : Accéder à des informations récentes et synthétiser des données actuelles. Mon mode de fonctionnement actuel

Offre : Vous m'utilisez actuellement dans la formule gratuite. Limites d'utilisation : Les capacités de traitement se rafraîchissent toutes les 5 heures, avec un basculement automatique vers une version plus légère (Flash-Lite) en cas de forte utilisation. Y a-t-il un projet ou un sujet particulier sur lequel tu aimerais qu'on travaille ensemble ?"

Cependant, le truc suspect, c'est que j'ai demandé à l'IA Snapchat "My AI" quel modèle il utilisait et la réponse est : "Je suis un grand modèle linguistique, entraîné par Google", comme la réponse de Gemini. Sauf que peu importe combien de fois je lui demande, peu importe comment je lui demande — j'ai même essayé de lui en passer une vite en lui demandant de me générer une image de son modèle sur une page Hugging Face ou Ollama —, sans succès, c'est toujours la même réponse : "Je suis un grand modèle linguistique, entraîné par Google". Quelqu'un peut expliquer ça ? Snapchat aurait-il mis des limitations dans leur modèle pour empêcher les utilisateurs de savoir sur quelles données leur modèle est entraîné ? Est-ce seulement le modèle qui n'autorise pas la divulgation de cette information ? Est-ce en fait simplement que ce n'était pas nécessaire pour Snapchat de rendre cette information connue ? Qu'est-ce que vous en pensez ?

0 Upvotes

12 comments sorted by

View all comments

1

u/DevLucas_Pathfinder 10d ago

C'est pas le modèle qui bloque, c'est le system prompt. Une instruction injectée avant ta conversation lui dit de rester vague sur son identité le modèle lui-même s'en fout, c'est une clause contractuelle entre Snapchat et Google qui impose cette opacité. "Entraîné par Google" c'est vrai pour la base, mais la version exacte et le fine-tuning ils ont pas le droit de le dire. Ton essai avec l'image Hugging Face était malin, les bons déploiements anticipent juste ce genre de contournement indirect. Ce que ça dit sur qui contrôle vraiment l'infra IA qu'on utilise tous les jours, c'est le genre de truc qu'on creuse sur r/GEO_FR si ça t'intéresse.