亚洲国产日韩欧美一区二区三区,精品亚洲国产成人av在线,国产99视频精品免视看7,99国产精品久久久久久久成人热,欧美日韩亚洲国产综合乱

Maison Périphériques technologiques IA Ce document de recherche a remporté le prix du meilleur papier ICML 2024

Ce document de recherche a remporté le prix du meilleur papier ICML 2024

Apr 16, 2025 am 09:21 AM

Un article révolutionnaire sur la diversité des ensembles de données dans l'apprentissage automatique

La communauté Machine Learning (ML) est en effervescence sur un récent lauréat du prix Paper ICML 2024 qui remet en question les affirmations de ?diversité? souvent insuffisantes dans les ensembles de données. Les chercheurs Dora Zhao, Jérone Ta Andrews, Orestis Papakyriakopoulos et le travail d'Alice Xiang, "Measy Datasity Diversity, ne se contentent pas de le réclamer", fournit un cadre indispensable pour évaluer rigoureusement la diversité des ensembles de données.

Ce document de recherche a remporté le prix du meilleur papier ICML 2024

Ce n'est pas seulement un autre article sur la diversité des ensembles de données; C'est un appel à l'action. Les auteurs critiquent l'utilisation lache de termes comme la ?diversité?, la ?qualité? et le ?biais? sans validation appropriée. Leur solution? Une approche structurée utilisant des principes de théorie de la mesure pour définir, mesurer et évaluer la diversité dans les ensembles de données ML.

Le cadre du journal comprend trois étapes cruciales:

  1. Conceptualisation: définir la "diversité" dans le contexte spécifique de l'ensemble de données.
  2. Opérationnalisation: Développement de méthodes concrètes pour quantifier les aspects définis de la diversité.
  3. évaluation: évaluation de la fiabilité et de la validité des mesures de diversité.

Les principaux résultats de leur analyse de 135 ensembles de données d'image et de texte révèlent des lacunes importantes: un manque de définitions claires de la diversité, une documentation insuffisante de la collecte de données, des problèmes de fiabilité et des défis dans la validation des allégations de diversité. Les chercheurs proposent des recommandations pratiques pour résoudre ces problèmes, notamment en utilisant un accord interannotateur et en utilisant des techniques à partir de la validité de construction.

Une étude de cas de l'ensemble de données sur tout (SA-1b) segment met en évidence l'application pratique du cadre, identifiant à la fois les forces et les domaines à améliorer ses considérations de diversité.

Les implications sont d'une grande portée: le document remet en question l'hypothèse que les ensembles de données plus importants équivalent automatiquement à une plus grande diversité, soulignant la nécessité d'une conservation intentionnelle. Il reconna?t également l'augmentation du fardeau de la documentation mais préconise des changements systémiques dans la fa?on dont le fonctionnement des données est évalué au sein de la communauté de recherche ML. En outre, il met en évidence l'importance de considérer comment les constructions de diversité évoluent avec le temps.

Lire l'article complet: Position: Mesurez la diversité des ensembles de données, ne vous contentez pas de le réclamer

La conclusion souligne la nécessité d'une recherche plus rigoureuse, transparente et reproductible en ML. Le cadre des auteurs fournit des outils essentiels pour s'assurer que les allégations de diversité des ensembles de données ne sont pas simplement des contributions rhétoriques mais manifestement significatives à des systèmes d'IA plus équitables et plus robustes. Ce travail est une étape critique vers l'amélioration de la conservation et de la documentation de l'ensemble de données, conduisant finalement à des modèles d'apprentissage automatique plus fiables et équitables.

Bien que l'augmentation de la rigueur puisse sembler exigeante, les auteurs soutiennent de manière convaincante que la construction d'IA sur les fondations tremblantes est inacceptable. Cet article n'est pas seulement une question de meilleurs ensembles de données; Il s'agit d'un domaine plus fiable et responsable de l'apprentissage automatique.

Questions fréquemment posées:

  • Q1: Pourquoi la mesure de la diversité des ensembles de données est-elle importante? A1: Il garantit une représentation diversifiée, réduit les biais, améliore la généralisation du modèle et favorise l'équité dans l'IA.
  • Q2: Comment la diversité des ensembles de données affecte-t-elle les performances du modèle ML? A2: Il améliore la robustesse et la précision en réduisant le sur-ajustement et l'amélioration des performances entre différentes populations et conditions.
  • Q3: Quels sont les défis courants dans la mesure de la diversité des ensembles de données? A3: Définir la diversité, opérationnaliser les définitions, valider les revendications et assurer une documentation transparente et reproductible.
  • Q4: Quelles sont les étapes pratiques pour améliorer la diversité des ensembles de données? A4: Définissant clairement des objectifs de diversité, collectant des données à partir de diverses sources, en utilisant des méthodes de mesure standardisées, une évaluation continue et la mise en ?uvre d'une validation robuste.

Ce qui précède est le contenu détaillé de. pour plus d'informations, suivez d'autres articles connexes sur le site Web de PHP en chinois!

Déclaration de ce site Web
Le contenu de cet article est volontairement contribué par les internautes et les droits d'auteur appartiennent à l'auteur original. Ce site n'assume aucune responsabilité légale correspondante. Si vous trouvez un contenu suspecté de plagiat ou de contrefa?on, veuillez contacter admin@php.cn

Outils d'IA chauds

Undress AI Tool

Undress AI Tool

Images de déshabillage gratuites

Undresser.AI Undress

Undresser.AI Undress

Application basée sur l'IA pour créer des photos de nu réalistes

AI Clothes Remover

AI Clothes Remover

Outil d'IA en ligne pour supprimer les vêtements des photos.

Clothoff.io

Clothoff.io

Dissolvant de vêtements AI

Video Face Swap

Video Face Swap

échangez les visages dans n'importe quelle vidéo sans effort grace à notre outil d'échange de visage AI entièrement gratuit?!

Outils chauds

Bloc-notes++7.3.1

Bloc-notes++7.3.1

éditeur de code facile à utiliser et gratuit

SublimeText3 version chinoise

SublimeText3 version chinoise

Version chinoise, très simple à utiliser

Envoyer Studio 13.0.1

Envoyer Studio 13.0.1

Puissant environnement de développement intégré PHP

Dreamweaver CS6

Dreamweaver CS6

Outils de développement Web visuel

SublimeText3 version Mac

SublimeText3 version Mac

Logiciel d'édition de code au niveau de Dieu (SublimeText3)

Kimi K2: le modèle agentique open source le plus puissant Kimi K2: le modèle agentique open source le plus puissant Jul 12, 2025 am 09:16 AM

Rappelez-vous le flot de modèles chinois open source qui a perturbé l'industrie du Genai plus t?t cette année? Alors que Deepseek a fait la majeure partie des titres, Kimi K1.5 était l'un des noms importants de la liste. Et le modèle était assez cool.

AGI et AI Superintelligence vont fortement frapper la barrière d'hypothèse du plafond humain AGI et AI Superintelligence vont fortement frapper la barrière d'hypothèse du plafond humain Jul 04, 2025 am 11:10 AM

Parlons-en. Cette analyse d'une percée innovante de l'IA fait partie de ma couverture de colonne Forbes en cours sur les dernières personnes en IA, notamment en identifiant et en expliquant diverses complexités d'IA percutantes (voir le lien ici). Se dirigeant vers Agi et

Grok 4 vs Claude 4: Quel est le meilleur? Grok 4 vs Claude 4: Quel est le meilleur? Jul 12, 2025 am 09:37 AM

à la mi-2025, l'AI ?Arme Race? se réchauffe, et Xai et Anthropic ont tous deux publié leurs modèles phares, Grok 4 et Claude 4.

Discussion approfondie sur la fa?on dont l'intelligence artificielle peut aider et nuire à tous les horizons Discussion approfondie sur la fa?on dont l'intelligence artificielle peut aider et nuire à tous les horizons Jul 04, 2025 am 11:11 AM

Nous discuterons: les entreprises commencent à déléguer des fonctions d'emploi pour l'IA, et comment l'IA remodèle les industries et les emplois, et comment les entreprises et les travailleurs travaillent.

10 robots humano?des incroyables qui marchent déjà parmi nous aujourd'hui 10 robots humano?des incroyables qui marchent déjà parmi nous aujourd'hui Jul 16, 2025 am 11:12 AM

Mais nous n'aurons probablement pas à attendre même 10 ans pour en voir un. En fait, ce qui pourrait être considéré comme la première vague de machines vraiment utiles, de type humain, est déjà là. Les dernières années ont vu un certain nombre de prototypes et de modèles de production sortant de T

L'ingénierie contextuelle est la & # 039; New & # 039; Ingénierie rapide L'ingénierie contextuelle est la & # 039; New & # 039; Ingénierie rapide Jul 12, 2025 am 09:33 AM

Jusqu'à l'année précédente, l'ingénierie rapide était considérée comme une compétence cruciale pour interagir avec les modèles de langage grand (LLM). Récemment, cependant, les LLM ont considérablement progressé dans leurs capacités de raisonnement et de compréhension. Naturellement, nos attentes

Construisez un coach de fitness Langchain: votre entra?neur personnel AI Construisez un coach de fitness Langchain: votre entra?neur personnel AI Jul 05, 2025 am 09:06 AM

De nombreuses personnes ont frappé le gymnase avec passion et croient qu'ils sont sur le bon chemin pour atteindre leurs objectifs de fitness. Mais les résultats ne sont pas là en raison d'une mauvaise planification de la régime alimentaire et d'un manque de direction. Embaucher un entra?neur personnel al

6 taches manus ai peut faire en quelques minutes 6 taches manus ai peut faire en quelques minutes Jul 06, 2025 am 09:29 AM

Je suis s?r que vous devez conna?tre l'agent général de l'IA, Manus. Il a été lancé il y a quelques mois, et au cours des mois, ils ont ajouté plusieurs nouvelles fonctionnalités à leur système. Maintenant, vous pouvez générer des vidéos, créer des sites Web et faire beaucoup de MO

See all articles