Llama 3.2 : La révolution de l'intelligence artificielle et de la vision Edge avec des modèles ouverts et personnalisables

Il semble que c'était hier que j'écrivais sur l'impact de Llama 3.1, et maintenant nous sommes confrontés à une autre étape importante dans l'intelligence artificielle avec la sortie de Llama 3.2 le 25 septembre 2024.

Introduction

Meta vient d'annoncer Llama 3.2 , une innovation qui promet de révolutionner l'IA embarquée et la vision par ordinateur. Cette nouvelle version propose des modèles de langage visuels à grande échelle (LLM) de petite et moyenne taille (11 et 90 milliards d'octets) ainsi que des modèles textuels légers (1 et 3 milliards d'octets), conçus pour s'adapter aux appareils mobiles et embarqués. Disponibles en versions pré-entraînées et optimisées, ces modèles offrent une flexibilité et des performances exceptionnelles pour une large gamme d'applications.

Quoi de neuf dans Llama 3.2

Modèles optimisés pour les appareils mobiles et Edge

Les modèles Llama 3.2 1B et 3B prennent désormais en charge une longueur de contexte allant jusqu'à 128 000 jetons , établissant ainsi une nouvelle norme pour les applications sur des appareils tels que :

  • Recherche et synthèse de connaissances multilingues
  • Suivi des instructions
  • Les tâches de réécriture s'exécutent localement

Optimisés pour le matériel des processeurs Qualcomm, MediaTek et ARM, ces modèles permettent un traitement efficace sans nécessiter d'infrastructure lourde.

Progrès en vision par ordinateur

Les modèles de vision Llama 3.2 11B et 90B peuvent immédiatement remplacer leurs équivalents textuels, surpassant même des modèles fermés comme Claude 3 Haiku dans les tâches de compréhension d'images. Contrairement à d'autres modèles multimodaux ouverts, les modèles pré-entraînés et alignés sont disponibles pour des ajustements personnalisés via torchtune et peuvent également être testés avec l'assistant Meta AI.

Llama Stack : simplifier le développement

Meta lance les premières distributions officielles de Llama Stack , qui simplifient considérablement la façon dont les développeurs travaillent avec les modèles Llama dans différents environnements :

  • Nœud unique
  • Sur place
  • Au nuage
  • Sur l'appareil

Cela permet la mise en œuvre clé en main d'applications de génération augmentée de récupération (RAG) et d'outils intégrés à la sécurité, accélérant ainsi le temps de développement et réduisant la complexité.

Partenariats stratégiques

En collaboration avec des partenaires tels qu'AWS , Databricks, Dell, Fireworks, Infosys et Together AI , Meta étend la portée de la suite Llama aux entreprises. La distribution sur les appareils est assurée par PyTorch ExecuTorch , tandis que la distribution sur un seul nœud est facilitée par Ollama.

L'ouverture qui stimule l'innovation

Meta continue de partager ses travaux car elle est convaincue que l'ouverture favorise l'innovation . Llama 3.2 fait figure de proue en matière d'ouverture, de modularité et de rentabilité, permettant ainsi à un plus grand nombre de personnes de réaliser des avancées créatives et transformatrices grâce à l'IA générative.

Disponibilité

Les modèles Llama 3.2 sont disponibles en téléchargement sur llama.com et Hugging Face , et sont également accessibles pour un développement immédiat sur un vaste écosystème de plateformes partenaires, notamment :

  • AMD
  • Google Cloud
  • IBM
  • Microsoft Azure
  • NVIDIA
  • Oracle Cloud
  • Et plein d'autres

Dernières pensées

Il me semble qu'hier encore, je parlais de l'impact de Llama 3.1, et maintenant, Llama 3.2 place la barre encore plus haut. La vitesse à laquelle la technologie évolue est vraiment impressionnante. J'ai hâte de voir comment ces avancées seront appliquées à différents secteurs et comment elles influenceront positivement nos projets et nos solutions.

Nouvelles

Articles liés

Les questions sur l'intelligence artificielle que se posent les entreprises

Lire l'article complet.

Sécurité de l'IA : gérer les risques

Lire l'article complet.

La Chine exige une identification obligatoire pour tout contenu généré par l'IA

Lire l'article complet.

« L’IA ne pense pas » — et c’est exactement pourquoi elle peut être utile.

Lire l'article complet.