IBM har lanceret Granite 4.2, en serie åbne sprogmodeller, som især er rettet mod virksomheder, der vil bygge AI-agenter. Hvor en almindelig chatbot primært svarer på spørgsmål, skal en agent også kunne vælge værktøjer, udføre flere trin i den rigtige rækkefølge og kontrollere sit eget resultat.

Tre størrelser til forskellige opgaver

Granite 4.2 kommer med 3, 8 og 30 milliarder parametre. Parameterantallet er et mål for modellens størrelse, men ikke i sig selv en garanti for kvalitet. De mindre udgaver kan bruges til mange gentagne opgaver, mens den største er tænkt til mere krævende analyse og programmering.

IBM fremhæver, at modellerne er trænet til blandt andet ræsonnement, kodning og brug af eksterne værktøjer. De kan køre i skyen, på en virksomheds egne servere eller tættere på den enhed, hvor de skal bruges. Det giver virksomheder flere muligheder for at vælge mellem pris, hastighed og kontrol over data.

Åben licens gør tilpasning mulig

Sprogmodellerne udgives under Apache 2.0-licensen. Det betyder, at udviklere kan hente, tilpasse og bruge dem i kommercielle løsninger uden de særlige licensbegrænsninger, som følger med mange andre modeller. Modellerne er allerede gjort tilgængelige gennem blandt andet GitHub, Hugging Face og Ollama.

IBM har samtidig udgivet to nye modeller til automatisk talegenkendelse. De er væsentligt mindre end sprogmodellerne og er lavet til hurtig omsætning af tale til tekst på blandt andet bærbare computere og telefoner. IBM peger især på direkte undertekster og analyse af store mængder kundesamtaler som mulige anvendelser.

Et alternativ til de største lukkede modeller

Granite 4.2 konkurrerer ikke kun på rå modelstørrelse. IBMs vinkel er, at virksomheder kan vælge en mindre model, som de selv kan drive og tilpasse til en afgrænset opgave. Hvor godt den løsning fungerer i praksis, vil stadig afhænge af opgaven, virksomhedens egne data og den kontrol, der bygges rundt om agenten.

Der er benyttet AI til at skrive denne artikel.