Categories: KI

LLMs in Unternehmen: Große Mehrheit setzt auf Open Source

Beim Einsatz von LLMs entscheiden sich Unternehmen sehr häufig für Open Source. Laut dem aktuellen Bericht State of Data & AI von Databricks liegt der Anteil bei 76 Prozent. Die Studie zeigt auch, dass KI die Testphase hinter sich gelassen hat und im Produktionsbetrieb angekommen ist.

Der Untersuchung zufolge wurden im Jahr 2023 11 Mal mehr KI-Modelle in Betrieb genommen: Im Durchschnitt wurden Unternehmen mehr als dreimal effizienter bei der Überführung von Modellen in den Produktionsbetrieb. Die Verarbeitung natürlicher Sprache (Natural Language) ist die meistgenutzte und am schnellsten wachsende Anwendung für maschinelles Lernen.

Retrieval Augmented Generation

Außerdem sollen 70 Prozent der Unternehmen, die GenAI nutzen, Tools und Vektordatenbanken verwenden, um die Basismodelle zu erweitern: Unternehmen konzentrieren sich demnach stark auf die Anpassung von LLMs mit ihren eigenen Daten durch Retrieval Augmented Generation (RAG). RAG erfordert laut Databricks bestimmte Vektordatenbanken, deren Nutzung um 377 Prozent im Vergleich zum Vorjahr gestiegen sind (einschließlich Open-Source- und geschlossenen LLMs).

Databricks fand auch heraus, dass 76 Prozent der Unternehmen, die LLMs nutzen, sich für Open Source oft neben proprietären Modellen entscheiden: Nur vier Wochen nach der Markteinführung machte Meta Llama 3 bereits 39 Prozent aller Open-Source-Modelle aus. Stark regulierte Branchen seien die überraschenden ersten GenAI-Anwender. Der Finanzdienstleistungssektor, der bei der GPU-Nutzung führend sei, habe sich am schnellsten entwickelt mit einem Wachstum von 88 Prozent innerhalb von sechs Monaten.

Experimentelles Testen der Modelle

„Unternehmen erstellen ihre Machine Learning (ML)-Modelle zunächst durch experimentelles Testen. Sie probieren verschiedene Algorithmen und Hyperparameter aus, um die besten Modelle zu finden, bevor sie diese in den Produktionsbetrieb geben“, teilte Databricks mit. „In diesem Prozess verfolgen die Teams zwei konkurrierende Ziele: Sie müssen sicherstellen, dass die Experimentierphase so zeiteffizient wie möglich ist und gleichzeitig nur streng getestete Modelle in Produktion geben.“

Der Bericht enthält auch eine Rangliste der zehn am häufigsten verwendeten Daten- und KI-Produkte. Neun von zehn sind Open-Source-Produkte. Der Grund dafür ist laut Databricks, dass Unternehmen dazu neigen, mehr Flexibilität zu wählen und gleichzeitig proprietäre Mauern und Einschränkungen zu vermeiden.

Stefan Beiersmann

Stefan unterstützt seit 2006 als Freier Mitarbeiter die ZDNet-Redaktion. Wenn andere noch schlafen, sichtet er bereits die Nachrichtenlage, sodass die ersten News des Tages meistens von ihm stammen.

Recent Posts

Black Friday: Vorsicht vor schädlichen QR-Codes

Bösartige QR-Codes, die per E-Mail versendet werden, eignen sich sehr gut, um Spam-Filter zu umgehen.

19 Stunden ago

Black Friday: Zahl der ominösen Shopping-Websites steigt

Unsichere Websites und Phishing-Mails in Verbindung mit Black Friday können kauffreudigen Konsumenten zum Verhängnis werden.

20 Stunden ago

SmokeBuster bekämpft SmokeLoader

Malware SmokeLoader wird weiterhin von Bedrohungsakteuren genutzt, um Payloads über neue C2-Infrastrukturen zu verbreiten.

1 Tag ago

Taugen Kryptowährungen als Unterstützer der Energiewende?

Bankhaus Metzler und Telekom-Tochter MMS testen, inwieweit Bitcoin-Miner das deutsche Stromnetz stabilisieren könnten.

2 Tagen ago

Supercomputer-Ranking: El Capitan überholt Frontier und Aurora

Mit 1,7 Exaflops ist El Capitan nun der dritte Exascale-Supercomputer weltweit. Deutschland stellt erneut den…

2 Tagen ago

Ionos führt neue AMD-Prozessoren ein

Der deutsche Hyperscaler erweitert sein Server-Portfolio um vier Angebote mit den neuen AMD EPYC 4004…

2 Tagen ago