28.07.2026

Classification des fruits par machine learning

La classification des fruits est l’une des applications les plus courantes de la vision par ordinateur en agriculture. Elle intervient dans le tri automatisé, l’évaluation de la maturité, le suivi des cultures et le contrôle qualité. Cet article explique comment concevoir des jeux de données annotés fiables pour entraîner des modèles capables de reconnaître les types de fruits, les variétés, les stades de maturité et les défauts visuels en conditions réelles.

Préparer et annoter des jeux de données de classification des fruits : taxonomie, méthodes, contrôle qualité et bonnes pratiques pour l’IA agricole.

Pourquoi la classification des fruits est stratégique pour l’IA agricole

La classification des fruits joue un rôle central dans l’agriculture moderne, car elle permet d’automatiser des décisions liées à la récolte, au tri et au contrôle qualité. Une reconnaissance visuelle fiable aide les producteurs à classer les fruits selon leur taille, leur couleur, leur maturité ou leur état de surface, tout en réduisant le travail manuel et en améliorant la régularité des chaînes d’approvisionnement. Les travaux de l’International Food Policy Research Institute montrent que les technologies de tri contribuent à l’efficacité des systèmes alimentaires et à la réduction des pertes après récolte. À mesure que la vision par ordinateur se déploie dans les vergers et les centres de conditionnement, la qualité des données annotées devient déterminante.

Comment le machine learning comprend les fruits

Un modèle apprend à classer les fruits à partir d’images annotées qui montrent des variations de texture, de couleur, de forme et de maturité. Ces exemples lui permettent d’associer des signaux visuels à une catégorie de fruit, une variété, un stade de maturité ou un niveau de qualité. La diversité des éclairages, des arrière-plans et des occlusions aide le modèle à généraliser au-delà des conditions contrôlées. Les ressources du département IFAS Horticultural Sciences de l’Université de Floride illustrent l’importance d’images de terrain et de laboratoire variées pour entraîner des systèmes robustes.

Types d’images utilisées

Un jeu de données de classification des fruits peut réunir des images prises dans des vergers, des serres, des usines de tri ou des points de distribution. Les images extérieures exposent le modèle à la lumière naturelle, aux ombres et aux conditions météo. Les images en environnement contrôlé facilitent les tâches de évaluation qualité lorsque l’éclairage reste stable. Les prises de vue rapprochées révèlent la texture, les défauts ou les irrégularités de surface, tandis que les images issues de drones ou de tracteurs peuvent couvrir des grappes de fruits à plus grande échelle.

Ce que le modèle apprend dans les images

Les modèles détectent des formes structurantes, comme la rondeur des pommes, la forme allongée des bananes ou les segments visibles des agrumes. Ils apprennent aussi des gradients de couleur liés à la maturité, par exemple le passage du vert au jaune pour les mangues ou du rouge clair au rouge foncé pour les fraises. Des annotations cohérentes garantissent que ces signaux visuels sont associés aux bons labels.

Concevoir une taxonomie de classification des fruits

La taxonomie définit les labels du jeu de données. Elle doit être cohérente, non ambiguë et alignée sur l’usage final. Sans catégories précises, les annotateurs interprètent différemment les types de fruits, les variétés ou les stades de maturité, ce qui dégrade les performances du modèle. Selon le projet, la taxonomie peut couvrir les types de fruits, les variétés, la maturité et les grades de qualité. La Royal Horticultural Society propose des références utiles sur les plantes et les fruits pour structurer les catégories.

Catégories de haut niveau

La plupart des projets commencent par des catégories larges : pomme, orange, banane, raisin ou fraise. Ces labels conviennent aux systèmes de tri et aux applications de reconnaissance visuelle où quelques familles de fruits suffisent. Ils réduisent le risque d’erreur, mais ne couvrent pas toujours la finesse nécessaire aux usages avancés.

Annotation au niveau de la variété

Certaines applications exigent de distinguer des variétés, par exemple Fuji et Gala pour les pommes, ou Valencia et Navel pour les oranges. Ces sous-catégories sont utiles pour la sélection variétale, le évaluation qualité de produits premium ou la recherche. Elles nécessitent des images haute résolution, des exemples visuels clairs et des annotateurs capables d’identifier les traits distinctifs.

Stades de maturité et niveaux de qualité

Les stades de maturité sont essentiels pour planifier la récolte et optimiser la chaîne logistique. Des labels comme immature, intermédiaire ou mûr aident les modèles à estimer le moment de récolte. Les niveaux de qualité peuvent inclure des fruits intacts, meurtris, tachés ou présentant d’autres défauts. Les ressources de l’Université de Californie Agriculture and Natural Resources peuvent aider à définir des critères de maturité et de qualité.

Collecter des images pour un jeu de données de classification

La création du jeu de données commence par des images représentatives des conditions dans lesquelles les fruits apparaissent réellement. Les environnements varient entre vergers, stations de conditionnement et marchés. Un jeu de données robuste doit intégrer la diversité géographique, la variabilité lumineuse, les arrière-plans, les saisons et les différences de matériel de prise de vue.

Photos de terrain et de vergers

Les images extérieures montrent les fruits parmi les feuilles, les branches, les ombres et les grappes irrégulières. Elles exposent les modèles aux vues partielles et aux occlusions. Collecter des photos à différents moments de la journée améliore la résistance du jeu de données aux variations d’éclairage.

Images d’usine et de ligne de tri

Les centres de transformation offrent un éclairage plus contrôlé. Les fruits y apparaissent souvent sur des convoyeurs, avec une orientation et un arrière-plan plus prévisibles. Ces images sont particulièrement adaptées aux modèles de évaluation qualité ou de tri automatisé.

Images de marché et de commerce de détail

Les contextes commerce de détail ajoutent des emballages, des étiquettes, des présentoirs mixtes et des arrière-plans plus complexes. Ils sont utiles pour les applications de caisse automatique, de suivi d’inventaire ou de reconnaissance produit. Cette diversité augmente la capacité de généralisation du modèle.

Prétraiter les images avant annotation

Le prétraitement rend les images plus cohérentes et prêtes à être annotées. Il peut inclure le recadrage, le redimensionnement, l’ajustement de la luminosité ou la normalisation des profils colorimétriques. Réduire le bruit visuel aide les annotateurs à se concentrer sur les fruits et accélère le travail de labellisation.

Normaliser la lumière et la couleur

La normalisation limite les écarts excessifs entre images intérieures et extérieures. Les réglages de luminosité, de contraste et de balance des couleurs rendent les détails plus lisibles. La diversité reste utile pour l’apprentissage, mais une variabilité trop forte peut créer des incohérences d’annotation.

Corriger la perspective et l’orientation

Des images prises sous des angles inhabituels peuvent nécessiter une rotation ou un alignement. Cette étape est importante pour les variétés dont la forme ou la symétrie constitue un signal visuel. Une orientation cohérente facilite les boîtes englobantes, les masques de segmentation et l’apprentissage des formes.

Réduire le bruit et les artefacts

Les reflets, les poussières, les débris ou le bruit capteur peuvent perturber l’annotation. Les réduire améliore la lisibilité des contours, surtout pour les masques pixel pixel par pixel. Des images propres produisent des labels plus fiables et des modèles plus stables.

Méthodes d’annotation pour la classification des fruits

La méthode d’annotation dépend de l’architecture du modèle et de l’objectif métier. Un jeu de données peut nécessiter des boîtes englobantes, des masques de segmentation, des étiquettes au niveau de l’image ou des points clés. Le bon format permet d’équilibrer précision, coût et utilité pour l’entraînement.

Boîtes englobantes

Les boîtes englobantes localisent chaque fruit dans l’image. Elles conviennent à la détection d’objets et aux scènes contenant plusieurs fruits. Les boîtes doivent être serrées, cohérentes et appliquées selon les mêmes règles par tous les annotateurs. Elles fonctionnent bien sur les convoyeurs et dans les vergers lorsque les fruits sont séparables.

Masques de segmentation

La segmentation trace la forme exacte du fruit au niveau du pixel. Elle est indispensable pour l’analyse fine des défauts, l’estimation de taille ou l’étude de la maturité. Plus coûteuse, elle apporte en revanche un niveau de détail supérieur, notamment lorsque les fruits se chevauchent ou se confondent avec les feuilles.

Labels de classification au niveau de l’image

Certains cas d’usage n’exigent qu’un label par image, surtout lorsque chaque photo contient un seul fruit dans un environnement de laboratoire. Cette approche permet de passer rapidement à l’échelle le jeu de données, mais elle est moins adaptée aux scènes complexes ou multi-objets.

Créer des consignes d’annotation fiables

Les consignes garantissent la cohérence d’un projet à grande échelle. Elles doivent expliquer les catégories, les cas limites, les règles d’exclusion et les exemples visuels. Sans instructions précises, les annotateurs peuvent interpréter différemment les variétés, les défauts ou les stades de maturité.

Définir des frontières claires entre catégories

Les annotateurs doivent savoir distinguer types de fruits, variétés et stades de maturité. Les consignes doivent inclure des exemples typiques, des défauts fréquents et des cas ambigus. Lorsque les différences visuelles sont subtiles, l’avis d’experts agronomes devient important.

Gérer les fruits partiellement visibles

Les grappes et les occlusions compliquent l’annotation. Les règles doivent préciser comment traiter les fruits cachés par des feuilles, des tiges ou d’autres fruits. En segmentation, les annotateurs peuvent devoir séparer des contours individuels malgré les chevauchements.

Traiter les échantillons ambigus

Certains fruits présentent une couleur atypique, des surfaces abîmées ou des formes irrégulières. Le protocole peut définir des catégories de défauts ou prévoir l’exclusion d’images trop peu lisibles. Une gestion uniforme de ces cas renforce l’intégrité du jeu de données.

Contrôle qualité des jeux de données de fruits

Le contrôle qualité vérifie que les annotations respectent les standards avant l’entraînement. Les revues multi-étapes détectent les erreurs de label, les boîtes mal alignées ou les masques imprécis. Un contrôle continu reste nécessaire au fur et à mesure que le jeu de données s’enrichit.

Revue en plusieurs niveaux

Un processus courant inclut une première vérification, une validation secondaire et, si nécessaire, une revue experte. Les relecteurs contrôlent l’alignement des boîtes, la précision des masques et la conformité des labels avec la taxonomie.

Apport d’experts agronomes

Les agronomes sont précieux pour les variétés, les stades de maturité et les structures complexes. Ils peuvent valider un échantillon d’annotations ou arbitrer les cas difficiles, ce qui réduit les erreurs que des annotateurs généralistes pourraient manquer.

Outils de validation automatisée

Les outils automatiques peuvent signaler des boîtes aux dimensions anormales, des labels manquants ou des formes incohérentes. Ils ne remplacent pas la revue humaine, mais accélèrent la détection des anomalies.

Défis fréquents dans l’annotation des fruits

Les jeux de données de fruits combinent variabilité environnementale, différences d’apparence et conditions de prise de vue hétérogènes. Identifier ces difficultés en amont permet de concevoir un protocole plus solide.

Variabilité des couleurs et de la maturité

La couleur d’un fruit évolue fortement avec la maturité. Si ces variations ne sont pas représentées, le modèle peut confondre catégories et stades. Un équilibrage des exemples par niveau de maturité améliore la robustesse.

Reflets et surfaces brillantes

De nombreux fruits reflètent la lumière, ce qui peut masquer la texture ou fausser la couleur. Le prétraitement réduit une partie des reflets, mais l’entraînement doit aussi inclure des conditions lumineuses variées.

Occlusions par feuilles ou emballages

Les fruits peuvent être cachés par des feuilles, des tiges, des emballages ou d’autres fruits. Les annotateurs doivent distinguer les limites visibles tout en appliquant des règles cohérentes sur les parties masquées.

Faire évoluer un jeu de données de classification des fruits

Les projets agricoles peuvent rapidement atteindre des milliers ou des dizaines de milliers d’images. Pour passer à l’échelle, il faut des outils efficaces, du pré-labellisation, un contrôle qualité structuré et un suivi de version du jeu de données.

Utiliser le pré-labellisation

Le pré-labellisation s’appuie sur des prédictions initiales que les annotateurs corrigent au lieu de créer chaque label à partir de zéro. Cette approche accélère les boîtes englobantes et les masques tout en standardisant le travail des équipes.

Choisir des outils adaptés

Les outils avancés doivent faciliter le dessin de polygones, la création de masques, les ajustements de boîtes, le zoom et les raccourcis clavier. Un bon outillage réduit le temps d’annotation et améliore la cohérence.

Étendre le jeu de données dans la durée

Les modèles s’améliorent avec des données nouvelles : nouvelles variétés, saisons, caméras ou environnements. L’ajout régulier d’images limite la dérive du modèle et maintient les performances après déploiement.

Comment les modèles utilisent les données annotées

Les jeux de données annotés alimentent des modèles de détection, de classification et d’évaluation qualité. Ils doivent fournir des labels cohérents pour apprendre des motifs visuels fiables. La US National Agriculture Library rassemble des références utiles sur les caractéristiques des fruits pour guider la préparation des données.

Entraîner des modèles de apprentissage profond

Les réseaux convolutionnels analysent d’abord des signaux simples comme les bords et les textures, puis apprennent des représentations plus complexes : forme, couleur, maturité ou défauts. Des jeux de données équilibrés évitent que le modèle n’apprenne des biais de catégorie.

Évaluer et tester

L’évaluation repose sur des données non vues pour mesurer l’accuracy, la précision et le rappel. Les jeux de test doivent couvrir la variabilité réelle des fruits et des conditions d’acquisition. La validation croisée aide à estimer la capacité de généralisation.

Déployer en conditions industrielles et agricoles

Les systèmes de classification fonctionnent dans des vergers, des serres, des usines ou des magasins. Le déploiement doit tenir compte de l’environnement, de la stabilité des caméras et de la vitesse de traitement. Les jeux de données annotés restent le socle d’un système fiable en production.

Comment DataVLab accompagne les projets de classification des fruits

Si vous développez des modèles de classification ou de reconnaissance des fruits, DataVLab peut vous aider à structurer, annoter et valider des jeux de données adaptés à l’IA agricole. Nos équipes interviennent sur la segmentation, les boîtes englobantes, les labels de maturité et les processus de contrôle qualité pour les environnements de verger, d’usine et de commerce de détail.

Sujets Principaux
Améliorez vos modèles IA avec des données annotées de qualité

Nos équipes vous accompagnent dans la création de données annotées fiables, prêtes à entraîner, évaluer et améliorer vos modèles IA.

Abstract blue gradient background with a subtle grid pattern.

Découvrez nos différents
Applications industrielles

Nos services d'étiquetage des données s'adressent à divers secteurs d'activité, garantissant des annotations de haute qualité adaptées à vos besoins spécifiques.

Services d'annotation de données

Exploitez tout le potentiel de vos applications d'IA grâce à notre technologie experte d'étiquetage des données. Nous garantissons des annotations de haute qualité qui accélèrent les délais de vos projets.

Services d'annotation de données agricoles

Services d'annotation de données agricoles pour l'IA agricole, la surveillance des cultures et l'analyse des champs

Annotation de haute précision pour les images agricoles, les données de drones et satellites, la surveillance des cultures, l'analyse du bétail et les flux de travail agricoles de précision.

Services d'annotation de données agritech

Services d'annotation de données agritech pour l'agriculture de précision, la robotique et l'IA environnementale

Annotation de haute précision pour les applications agritech, notamment l'agriculture de précision, la robotique de terrain, l'analyse multispectrale, la prévision du rendement et la surveillance environnementale.

Annotation d'images de drones

Annotation d'images de drones

Annotation de haute précision d'images capturées par drone pour des applications d'inspection, de construction, d'agriculture, de sécurité et environnementales.

Services d'annotation de plantes

Services d'annotation des plantes pour le phénotypage, la détection des maladies et la recherche agronomique

Annotation de haute précision au niveau des plantes pour la segmentation des feuilles, la détection des maladies, le phénotypage, l'analyse de la croissance et les jeux de données agricoles scientifiques.