Quelle est la précision de la reconnaissance alimentaire par IA ? Ce qu'il faut en attendre
Publié en avril 2026
Enregistrer un repas par photo grâce à l'IA est nettement plus rapide que de chercher à la main dans une base de données. Mais avant de changer d'application, une question revient toujours : à quel point est-ce précis, vraiment ? La réponse honnête est que cela dépend de ce que tu manges et de la façon dont tu le photographies. Voici ce que la technologie sait faire et ce qu'elle ne sait pas faire.
Comment fonctionne la reconnaissance alimentaire par IA
Quand tu photographies un repas, un modèle de vision par IA analyse l'image pour identifier chaque aliment. Il observe les formes, les couleurs, les textures et le contexte pour déterminer ce qu'il y a dans l'assiette. Une fois les aliments identifiés, le système estime les portions à partir d'indices visuels, dont la taille apparente de chaque élément par rapport à l'assiette, aux couverts ou à d'autres points de repère dans le cadre.
À partir de ces estimations, il calcule les calories et les macronutriments avec les valeurs nutritionnelles des aliments identifiés. L'ensemble prend en général quelques secondes.
Quelle est sa précision ?
Pour les repas courants et bien visibles, la reconnaissance alimentaire par IA est raisonnablement précise. Une assiette avec un blanc de poulet, du riz et des légumes vapeur est typiquement un repas où l'IA fonctionne bien. Les composants sont visibles, les portions estimables, et ce sont des aliments que le modèle aura vus de nombreuses fois. Dans ces cas, les estimations de calories se situent en général à 10 à 20% du chiffre réel.
La précision chute sur les plats composés. Un ragoût, un gratin ou un curry contient des ingrédients partiellement ou totalement cachés. L'IA peut identifier le plat, mais elle ne voit pas ce qu'il y a dedans : les estimations reposent donc davantage sur des recettes types que sur le contenu réel de ta casserole. La marge d'erreur s'élargit.
Les sauces, les huiles et les vinaigrettes posent toujours problème. Une salade assaisonnée à l'huile d'olive et une salade assaisonnée d'une vinaigrette légère sont presque identiques en photo. L'écart de calories entre les deux peut être important. Les huiles de cuisson ajoutées dans la poêle avant de faire sauter les aliments sont, elles, totalement invisibles sur la photo finale.
Les aliments emballés avec une étiquette nutritionnelle se saisissent mieux à la main ou par lecture du code-barres. Une portion de 200 g d'un yaourt de marque précis a un profil nutritionnel connu et exact. L'estimation par IA ajoute une incertitude inutile quand la vérité est imprimée sur l'emballage.
Ce qui influence la précision
Plusieurs facteurs concrets influencent la qualité du résultat de l'IA sur une photo donnée :
- L'éclairage. Une photo bien éclairée donne au modèle plus d'informations visuelles. Un mauvais éclairage aplatit les textures et fausse les couleurs, ce qui rend l'aliment plus difficile à identifier correctement.
- Angle. Les photos prises du dessus (directement au-dessus de l'assiette) donnent en général les meilleurs résultats. Les angles de côté peuvent masquer des aliments derrière d'autres et rendre l'estimation des portions moins fiable.
- La disposition des aliments. Des aliments étalés dans l'assiette en portions distinctes s'analysent mieux qu'une présentation empilée ou mélangée. Si tu as plusieurs éléments, les séparer avant de photographier aide.
- Objets de référence. Faire figurer le bord d'une assiette, une fourchette ou un autre objet familier dans le cadre aide le modèle à calibrer la portion. Un morceau de poulet paraît très différent à côté d'une fourchette et à côté de rien.
Les plats composés sont plus difficiles que les aliments seuls
Un blanc de poulet grillé à côté de riz et de brocolis, ce sont trois formes distinctes aux contours nets. Un curry, un ragoût, un gratin ou une salade assaisonnée, c'est une seule masse visuelle où les composants se chevauchent, se cachent et varient en densité. L'IA estime le second cas nettement moins bien, et c'est le principal facteur qui détermine si une estimation photo sera juste.
La revue systématique de 2023 parue dans Annals of Medicine, portant sur 52 études publiées entre 2010 et 2023, a relevé des erreurs relatives moyennes sur les calories allant de 0,10 % à 38,3 %, et rapporté que les erreurs « tendaient à être plus faibles pour les images d'un aliment unique que pour les images de plusieurs aliments ». Elle pointe directement le cas difficile : « les images de plats mélangés (comme les curries) ou d'assiettes présentant divers aliments superposés, de hauteurs variables ou aux contours flous présentent un risque plus élevé d'erreurs de classification ou de segmentation ». Sur les 22 erreurs d'estimation de volume les plus faibles parmi les études examinées, 68 % provenaient d'images d'un aliment unique.
Une analyse de 2023 de GPT-4V comparé à des repas pesés de référence a chiffré l'écart. Estimer un aliment à la fois donnait une erreur absolue moyenne de 69,2 kcal. Estimer l'ensemble de la prise alimentaire donnait 151,2 kcal, soit environ le double. La cause est cumulative : la taille des portions est la source d'erreur dominante, et un plat composé demande un jugement de portion distinct pour chaque composant, chacun avec son erreur propre.
Ce point n'est pas totalement tranché. Une étude de 2025 parue dans Nutrients, portant sur 195 plats, n'a trouvé qu'une corrélation faible entre le nombre d'ingrédients et l'erreur (r ne dépassant pas 0,37) et a conclu que le nombre de composants n'était pas un facteur déterminant. Le résumé honnête est que la séparabilité visuelle compte plus que le nombre d'ingrédients : une assiette contenant six aliments nettement séparés est plus facile qu'un bol contenant trois aliments mélangés.
Ce que cela veut dire en pratique
- Photographie avant de mélanger. Prends les composants tant qu'ils sont encore distincts, pas le bol une fois remué.
- Sépare un plat composé en deux photos quand c'est raisonnablement possible. Deux estimations simples valent mieux qu'une estimation composite.
- Corrige l'estimation pour tout ce qui est mixé, en sauce ou en couches. Les lipides sont le nutriment le plus systématiquement sous-estimé dans toutes les études, et l'huile d'une sauce est invisible sur une photo.
- Considère les ragoûts et les currys maison comme le pire des cas, et enregistre-les à partir des ingrédients plutôt que d'une photo quand le repas compte.
Comparé à quoi ?
La bonne comparaison n'est pas l'IA face à un chiffre parfait, c'est l'IA face à la façon dont tu enregistrerais autrement le repas, qui est elle aussi imprécise.
Une étude de 2018 parue dans Nutrients a demandé à 38 professionnels de la nutrition d'estimer des portions à partir de photos d'aliments. Seules 23,7 % de leurs estimations se situaient à moins de 10 % du poids réellement mesuré, avec un écart absolu moyen de 47,6 %. Dans les travaux Nutrition5k présentés à CVPR 2021, où chaque ingrédient d'environ 5 000 plats a été pesé, les nutritionnistes professionnels se trompaient en moyenne de 41 % et les non-professionnels de 53 %.
L'enregistrement manuel dans une application ne fait pas mieux. Une méta-analyse de 2022 parue dans Advances in Nutrition, regroupant 11 études sur des applications de journal alimentaire, a montré qu'elles sous-estimaient l'apport énergétique de 202 kcal par jour en moyenne (IC à 95 % : 319 à 85 kcal).
L'estimation par photo d'un plat composé est donc imprécise. Celle d'un diététicien devant la même assiette l'est aussi, et la saisie à la main également. Ce que change l'enregistrement par photo n'est pas la précision, mais le fait que tu enregistres le repas ou non, et un repas enregistré avec une estimation corrigeable vaut mieux qu'un repas non enregistré.
Méfie-toi des promesses de précision
Plusieurs sites publient des chiffres de précision d'apparence rigoureuse pour les apps de calories, certains citant des études et des DOI qui n'existent pas. Aucune app ne dispose d'une validation publiée et évaluée par des pairs de son produit commercialisé. Quand un chiffre n'a derrière lui ni revue nommée, ni taille d'échantillon, ni méthodologie, traite-le comme du marketing. Cela vaut aussi pour les nôtres : les chiffres de cette page sont cités à partir de recherches indépendantes, pas de nos propres tests.
Est-ce que « à peu près juste » suffit ?
Pour la plupart des gens, oui. Une marge d'erreur de 10 à 20 % semble importante prise isolément, mais le contexte compte.
Les saisies manuelles depuis une base de données ne sont pas parfaitement exactes non plus. Les bases alimentées par les utilisateurs contiennent des erreurs, les définitions de portions varient d'une source à l'autre, et les plats faits maison correspondent rarement au mode de préparation supposé par une fiche de base de données. En pratique, la précision de la saisie manuelle pour les plats maison est plus faible que la plupart des gens ne le pensent.
Plus important encore, pour un suivi, la régularité compte plus que la précision. Si tu compares les applications basées sur l'IA aux applications à base de données classiques, la comparaison VitaCal vs MyFitnessPal détaille les différences pratiques de saisie. Si l'IA se trompe systématiquement de 15% sur un repas que tu manges souvent, ton apport enregistré reflète quand même ton apport réel en valeur relative. Tes tendances hebdomadaires, tes réactions aux changements alimentaires et ta progression dans le temps restent tous pertinents. Le but du suivi est de développer une conscience de ses habitudes et de repérer des schémas, pas d'atteindre une précision de laboratoire à chaque repas.
Ce qui casse le suivi, ce n'est pas une marge d'erreur de 15%. Ce qui casse le suivi, c'est l'abandon de l'habitude parce que l'enregistrement est trop lent ou trop pénible. Le suivi photo par IA s'attaque directement à ce problème.
Comment obtenir de meilleurs résultats
Quelques habitudes simples améliorent la qualité des estimations de l'IA :
- Vérifie ce que l'IA a identifié avant de valider l'enregistrement. Si elle a oublié un ingrédient ou s'est trompée, tu peux corriger avant d'enregistrer.
- Photographie à la verticale, au-dessus de l'assiette, avec un bon éclairage. Ça prend une seconde de plus et la différence est mesurable.
- Pour les repas où la précision compte, enregistre les composants séparément plutôt que l'assiette entière. Le modèle a alors une tâche plus nette pour chaque élément.
- Utilise la saisie manuelle pour les aliments emballés. S'il y a une étiquette nutritionnelle, sers-t'en. Réserve l'enregistrement par IA aux repas où il a un vrai avantage : plats cuisinés, repas au restaurant et tout ce que tu devrais autrement chercher dans une base.
L'approche de VitaCal
VitaCal te montre exactement ce que l'IA a identifié sur ta photo avant que quoi que ce soit soit enregistré. Tu vois chaque aliment, sa portion estimée, et les calories et macros qui en découlent. Si quelque chose cloche, tu peux ajuster les portions ou retirer des éléments avant de confirmer. Rien n'est enregistré sans ta vérification.
Les photos sont supprimées dès la fin de l'analyse et ne sont jamais rattachées au repas que tu enregistres. Tes photos de repas t'appartiennent.
Si tu veux voir comment le suivi par IA fonctionne en pratique, essaie VitaCal gratuitement. L'offre gratuite comprend cinq analyses IA par semaine, sans publicité.