Een nieuwe reeks AI-modellen, LFM2.5-Encoders, belooft grote hoeveelheden tekst veel efficiënter te verwerken op standaard processors (CPU’s), zonder dat daarvoor dure grafische kaarten nodig zijn. Dit type modellen richt zich specifiek op het razendsnel analyseren van lange documenten, iets waar veel bestaande AI-systemen moeite mee hebben omdat ze zwaar leunen op krachtige GPU’s.
Het bijzondere aan deze encoders is dat ze zijn geoptimaliseerd om ook met beperkte rekenkracht goed te presteren. Dat maakt de technologie interessant voor bedrijven en ontwikkelaars die AI willen inzetten op gewone servers, laptops of zelfs kleinere apparaten, zonder torenhoge kosten voor cloud-GPU’s. Vooral toepassingen waarbij lange context nodig is, zoals het doorzoeken van juridische documenten, wetenschappelijke artikelen of uitgebreide klantendossiers, kunnen hiervan profiteren.
Deze ontwikkeling past in een bredere trend binnen AI: modellen worden steeds vaker ontworpen met efficiëntie als uitgangspunt, in plaats van pure rekenkracht. Door slimmer om te gaan met beschikbare hardware wordt AI toegankelijker voor kleinere organisaties. Als deze aanpak zich verder doorzet, kan het de drempel voor het gebruik van geavanceerde taalmodellen aanzienlijk verlagen.