Es kommt mir vor, als hätte ich erst gestern über die Auswirkungen von Llama 3.1 geschrieben, und nun stehen wir mit der Veröffentlichung von Llama 3.2 am 25. September 2024 vor einem weiteren bedeutenden Meilenstein in der künstlichen Intelligenz.
Einführung
Meta hat soeben Llama 3.2 angekündigt , eine Innovation, die die Landschaft der Edge- und Bildverarbeitungs-KI revolutionieren wird. Diese neue Version bietet umfangreiche Bildverarbeitungs-Sprachmodelle (LLMs) in kleinen und mittleren Größen (11 B und 90 B) sowie schlanke Textmodelle (1 B und 3 B), die speziell für mobile Geräte und Edge-Geräte entwickelt wurden. Die Modelle sind in vortrainierten und instruktionsoptimierten Versionen verfügbar und bieten außergewöhnliche Flexibilität und Leistung für ein breites Anwendungsspektrum.
Was ist neu in Llama 3.2
Für Mobilgeräte und Edge optimierte Vorlagen
Die Modelle Llama 3.2 1B und 3B unterstützen nun eine Kontextlänge von bis zu 128 Tokens und setzen damit einen neuen Standard für Anwendungen auf Geräten wie:
- Mehrsprachige Wissensabfrage und -zusammenfassung
- Anweisungsnachverfolgung
- Umschreibaufgaben werden lokal ausgeführt
Diese Modelle sind für die Prozessorhardware von Qualcomm, MediaTek und ARM optimiert und ermöglichen eine effiziente Verarbeitung ohne die Notwendigkeit einer umfangreichen Infrastruktur.
Fortschritte in der Computervision
Die Llama 3.2 11B- und 90B- Bildverarbeitungsmodelle können ihre Textäquivalente sofort ersetzen und übertreffen bei Bildverarbeitungsaufgaben sogar geschlossene Modelle wie Claude 3 Haiku. Im Gegensatz zu anderen offenen multimodalen Modellen sind sowohl vortrainierte als auch ausgerichtete Modelle für individuelle Anpassungen mit torchtune verfügbar und können zudem mit dem Meta AI-Assistenten getestet werden.
Llama Stack: Vereinfachung der Entwicklung
Meta veröffentlicht die ersten offiziellen Distributionen des Llama Stacks , der die Arbeit von Entwicklern mit Llama-Vorlagen in verschiedenen Umgebungen deutlich vereinfacht:
- Einzelknoten
- Auf dem Gelände
- Jetzt
- Auf dem Gerät
Dies ermöglicht die schlüsselfertige Implementierung von Recovery-Augmented Generation (RAG)-Anwendungen und sicherheitsintegrierten Tools, wodurch die Entwicklungszeit verkürzt und die Komplexität reduziert wird.
Strategische Partnerschaft
In Zusammenarbeit mit Partnern wie AWS , Databricks, Dell, Fireworks, Infosys und Together AI erweitert Meta die Reichweite des Llama Stacks auf Unternehmenskunden. Die Verteilung auf Endgeräte erfolgt über PyTorch ExecuTorch , während die Verteilung auf Einzelknoten durch Ollama ermöglicht wird.
Offenheit, die Innovationen vorantreibt
Meta teilt seine Arbeit weiterhin, weil das Unternehmen davon überzeugt ist, dass Offenheit Innovation fördert . Llama 3.2 ist führend in puncto Offenheit, Anpassbarkeit und Kosteneffizienz und ermöglicht es mehr Menschen, mithilfe generativer KI kreative und transformative Durchbrüche zu erzielen.
Verfügbarkeit
Die Llama 3.2- Vorlagen stehen auf llama.com und Hugging Face zum Download bereit und können außerdem für die sofortige Entwicklung in einem breiten Ökosystem von Partnerplattformen genutzt werden, darunter:
- AMD
- Cumolocity
- IBM
- Microsoft Azure
- NVIDIA
- Oracle Cloud
- Und viele andere
Abschließende Gedanken
Es kommt mir vor, als hätte ich erst gestern die Auswirkungen von Llama 3.1 besprochen, und jetzt ist Llama 3.2 da, um die Messlatte noch höher zu legen. Die Geschwindigkeit, mit der sich die Technologie weiterentwickelt, ist wirklich beeindruckend. Ich bin gespannt, wie diese Fortschritte in verschiedenen Branchen Anwendung finden und wie sie unsere Projekte und Lösungen positiv beeinflussen können.




