.png)
Forschung, die souveräne KI effizient und praktisch einsetzbar macht
Unser Beitrag zu Soofi geht über das Foundation Model hinaus. Mit EntQuant haben unsere Forscher:innen einen neuartigen Ansatz zur Modellkompression entwickelt, der große KI-Modelle effizienter und einfacher deploybar macht.
- Extreme Kompression - EntQuant ermöglicht die Kompression großer Modelle auf extrem niedrige Bitraten – bei gleichzeitig hoher funktionaler Leistungsfähigkeit.
- Ohne Kalibrierungsdaten - Der Ansatz funktioniert ohne zusätzliche Kalibrierungsdaten und macht die Kompression dadurch schneller und flexibler.
- Schnell & effizient - Ein 70B-Parameter-Modell lässt sich in weniger als 10 Minuten komprimieren – und damit deutlich effizienter für den praktischen Einsatz machen.
- Für Soofi S - EntQuant wird eingesetzt, um komprimierte Versionen von Soofi S zu ermöglichen und damit den Weg von Forschung zu effizientem Deployment zu verkürzen.
.png)
