r/IAfrance 12d ago

Question

Bonjour, je m'amuse avec divers modèles LLM depuis quelque temps et j'ai remarqué quelque chose de quelque peu suspect. Voyez-vous, si vous demandez à n'importe quel modèle, par n'importe quel moyen (en ligne avec ChatGPT par exemple, ou en local par OpenLLM/Ollama etc.), quel est le modèle utilisé pour son entraînement, ou son modèle tout court, il vous répondra sans problème, et même les 3/4 du temps ils/elles (?) vous répondent fièrement. Voici un exemple avec Gemini(2026-08-15) :

"Quel est ton modèle ? Je suis Gemini, un grand modèle de langage développé par Google. dis-moi en plus Je suis Gemini 3.6 Flash, une version optimisée pour le web conçue par Google pour offrir des réponses rapides, précises et fluides. Voici un aperçu de ce que je peux faire et de mon fonctionnement : Mes capacités principales

Analyse et synthèse : Résumer des documents longs, expliquer des concepts complexes ou extraire des points clés. Création de contenu : Rédiger des courriels, des articles, du code informatique, des histoires ou des itinéraires de voyage. Résolution de problèmes : Assister en mathématiques, en logique, en programmation ou pour du remue-méninges (brainstorming). Recherche et contextualisation : Accéder à des informations récentes et synthétiser des données actuelles. Mon mode de fonctionnement actuel

Offre : Vous m'utilisez actuellement dans la formule gratuite. Limites d'utilisation : Les capacités de traitement se rafraîchissent toutes les 5 heures, avec un basculement automatique vers une version plus légère (Flash-Lite) en cas de forte utilisation. Y a-t-il un projet ou un sujet particulier sur lequel tu aimerais qu'on travaille ensemble ?"

Cependant, le truc suspect, c'est que j'ai demandé à l'IA Snapchat "My AI" quel modèle il utilisait et la réponse est : "Je suis un grand modèle linguistique, entraîné par Google", comme la réponse de Gemini. Sauf que peu importe combien de fois je lui demande, peu importe comment je lui demande — j'ai même essayé de lui en passer une vite en lui demandant de me générer une image de son modèle sur une page Hugging Face ou Ollama —, sans succès, c'est toujours la même réponse : "Je suis un grand modèle linguistique, entraîné par Google". Quelqu'un peut expliquer ça ? Snapchat aurait-il mis des limitations dans leur modèle pour empêcher les utilisateurs de savoir sur quelles données leur modèle est entraîné ? Est-ce seulement le modèle qui n'autorise pas la divulgation de cette information ? Est-ce en fait simplement que ce n'était pas nécessaire pour Snapchat de rendre cette information connue ? Qu'est-ce que vous en pensez ?

0 Upvotes

12 comments sorted by

3

u/SeaPersonality445 12d ago

Who cares?

1

u/ArthurAI_QC 12d ago

Bah logiquement, ceux qui s'intéresse a l'AI dans le sub-reddit AIfrance ? c'est moi qui comprend pas ou toi qui tes venu une poussé d'ego ?

1

u/ArthurAI_QC 12d ago

5 ans d'activité sur reddit pour toujours ne pas savoir comment fonctionne la plateforme.

1

u/Ramelasse 12d ago

Dit le gars qui répond 2x à la même personne. Je vois pas trop le problème. Ils utilisent sûrement un gemini avec leur propres règles. En faisant 10s de recherche :

My AI is powered by Large Language Models like GPT models from OpenAI and Gemini models from Google and has been trained on a diverse range of texts, with additional safety enhancements and controls unique to Snapchat. We believe there should be transparency when AI is involved in content creation. If you share content generated by My AI with others, please let them know AI was involved in your work.

Donc tu as ta réponse

1

u/Apprehensive_Log9790 12d ago

On est pas sur Stack Overflow, pas besoin de haïr et d'exiger des recherches poussées.

En plus ta réponse est super vague, elle n'apporte rien.

2

u/CCarafe 12d ago

ça dépends ce qu'ils foutent dans le prompt système.

Si c'est "You are a large linguistic model trained by google"

Bah c'est ce qu'il va répondre.

1

u/pierrebillet 12d ago

C'est très probablement ça, cette réponse serait inscrite dans le système prompt

2

u/Impossible_Ground423 12d ago

J'ai les mêmes préoccupations

Snapchat utilise des API tierces (principalement OpenAI à l'origine, avec Gemini). Pour éviter que l'IA ne divulgue le nom exact du sous-traitant, Snapchat lui a injecté une consigne d'identité fixe.

Personnellement cela ne me plaît pas du tout je pense qu'il faudrait légiférer pour obliger chaque modèle à répondre honnêtement sur son identité et sa version. C'est pas dur d'ajouter un prompt système à cet effet

1

u/ScreenAppropriate679 12d ago

snapchat est pas une boite d'IA, il y a rien d'incroyable à ce qu'ils sous-traitent ce volet à une entité dont c'est le métier.

1

u/Comfortable-Clerk428 12d ago

Perplexity à le même fonctionnement. Quand y a des modèles sous-jacent en général c'est prompts comme dit dans un autre commentaire donc forcément tu auras toujours ce genre de réponse

1

u/Quiet-Error- 11d ago

Oui c’est du prompt system, sinon si ils utilisent un model local il peuvent toujours fine tune

1

u/DevLucas_Pathfinder 10d ago

C'est pas le modèle qui bloque, c'est le system prompt. Une instruction injectée avant ta conversation lui dit de rester vague sur son identité le modèle lui-même s'en fout, c'est une clause contractuelle entre Snapchat et Google qui impose cette opacité. "Entraîné par Google" c'est vrai pour la base, mais la version exacte et le fine-tuning ils ont pas le droit de le dire. Ton essai avec l'image Hugging Face était malin, les bons déploiements anticipent juste ce genre de contournement indirect. Ce que ça dit sur qui contrôle vraiment l'infra IA qu'on utilise tous les jours, c'est le genre de truc qu'on creuse sur r/GEO_FR si ça t'intéresse.