Que sont les entrées d’image et comment fonctionnent-elles dans ChatGPT ?
ChatGPT dispose désormais de capacités d’image pour comprendre et interpréter les images que vous ajoutez aux conversations comme entrées d’image.
Comment utiliser les entrées d’image dans les conversations ?
Utilisation de base : téléversez une photo pour commencer. Posez des questions sur les objets présents dans les images, analysez des documents ou explorez du contenu visuel. Ajoutez d’autres images lors des échanges suivants pour approfondir ou réorienter la discussion. Revenez à tout moment avec de nouvelles photos.
Annotation des images : pour attirer l’attention sur des zones précises, vous pouvez utiliser un outil de retouche permettant de marquer votre photo avant de la téléverser. Cela aide ChatGPT à se concentrer sur les éléments que vous jugez importants.
Quels forfaits peuvent utiliser les entrées d’image ?
Plus et ChatGPT Enterprise. Sur le Web mobile, vous pouvez également joindre des photos avant de vous connecter.
Quels modèles peuvent accepter des entrées d’image ?
Tous les modèles ChatGPT peuvent accepter des entrées d’image.
Sur quelles plateformes les entrées d’image sont-elles disponibles ?
Sur toutes les plateformes, y compris le Web (chatgpt.com) et le mobile (iOS / Android).
Mes images sont-elles utilisées pour améliorer vos modèles ?
Notre approche de l’utilisation du contenu, y compris les images, reste la même pour chaque produit.
Veuillez consulter Comment vos données sont utilisées pour améliorer les performances du modèle afin de mieux comprendre comment le contenu de ChatGPT peut être utilisé pour améliorer les performances du modèle, ainsi que les choix dont disposent les utilisateurs.
Pour ChatGPT Enterprise, nous n’utilisons pas le contenu pour entraîner nos modèles.
Comment ajouter des entrées d’image dans ChatGPT ?
Appuyez sur l’icône + dans la zone du prompt, puis sélectionnez Ajouter des photos et des fichiers. Vous pouvez également faire glisser un fichier image dans la zone de texte ou coller une image copiée dans votre presse-papiers.
Les entrées d’image prennent-elles en charge les vidéos ?
Non, elles ne peuvent pas traiter les vidéos. Elles ne prennent actuellement en charge que le traitement d’images statiques.
Quels types de fichiers sont pris en charge ?
Combien d’images puis-je téléverser en une seule fois ?
Le nombre d’images que vous pouvez ajouter à une conversation dépend de plusieurs facteurs, notamment la taille des images et la quantité de texte qui les accompagne. De manière générale, si vous rencontrez des problèmes, essayez de réduire le nombre ou la taille des images.
Quelle est la limite de taille par image ?
20 Mo.
Comment les capacités d’image traitent-elles les images ambiguës ou peu claires ?
Si une image est ambiguë ou peu claire, le modèle fera de son mieux pour l’interpréter. Cependant, les résultats peuvent être moins précis.
Quelles limites les utilisateurs doivent-ils connaître lorsqu’ils utilisent ChatGPT avec les entrées d’image ?
Si vous utilisez la nouvelle fonctionnalité d’entrée d’image de ChatGPT, il est important de connaître les limites suivantes :
Médical : le modèle n’est pas adapté à l’interprétation d’images médicales spécialisées comme les scanners, et ne doit pas être utilisé pour obtenir des conseils médicaux.
Langues autres que l’anglais : le modèle est moins performant lorsqu’il traite des images contenant du texte dans des alphabets non latins, comme le japonais ou le coréen.
Texte de grande taille : agrandissez le texte dans l’image pour améliorer sa lisibilité, mais évitez de rogner des détails importants.
Rotation : le modèle peut mal interpréter du texte ou des images pivotés ou à l’envers.
Éléments visuels : le modèle peut avoir du mal à comprendre des graphiques ou du texte lorsque les couleurs ou les styles varient, par exemple avec des lignes pleines, en pointillés ou en tirets.
Spatial : le modèle rencontre des difficultés avec les tâches nécessitant une localisation spatiale précise, comme l’identification de positions aux échecs.
Précision : le modèle peut générer des descriptions ou des légendes incorrectes dans certains cas.
Forme : le modèle a du mal avec les images panoramiques et fisheye.
Métadonnées et redimensionnement : le modèle ne traite pas les noms de fichiers d’origine ni les métadonnées, et les images sont redimensionnées avant l’analyse, ce qui affecte leurs dimensions d’origine.
Comptage : peut fournir des nombres approximatifs pour les objets présents dans les images.
