En udvikler har fået llama.cpp til at køre på Apple Watch med en lokal 0.8B-sprogmodel. Det er en nørdet demo, ikke en færdig funktion til almindelige brugere. Det interessante er, at Apple Watch-hardware kan presses længere, end de fleste forventer.
Det konkrete nye er enkelt: llama.cpp er porteret til Apple Watch, og en 0.8B LLM kører lokalt på uret. Der er ikke oplyst noget om officiel udgivelse, bred tilgængelighed eller en løsning, som bare kan installeres af almindelige Apple Watch-brugere.
Netop derfor er dette først og fremmest en monitor-historie for Apple-læsere. Nyhedsværdien ligger ikke i, at Apple Watch pludselig er blevet en AI-enhed, men i at en udvikler har demonstreret lokal modelkørsel på et produkt, der normalt forbindes med hurtige apps, notifikationer og sundhedsfunktioner.
Det giver en konkret Apple-vinkel, fordi lokal behandling er et centralt spørgsmål i hele Apples økosystem. Når noget kan køre direkte på enheden, peger det mod bedre privatliv og mindre afhængighed af skyen. Men inputtet siger intet om hastighed, batteriforbrug eller hvor brugbar oplevelsen faktisk er på et ur.
Det er også vigtigt at holde proportionerne på plads. En 0.8B-model på Apple Watch er teknisk interessant, men det er ikke det samme som en praktisk chatbot på håndleddet. Uden flere detaljer ved vi ikke, om demoen er et hurtigt eksperiment eller et første skridt mod noget, andre kan bygge videre på.
For danske Apple-brugere ændrer det derfor ikke, hvad man skal købe eller vente på i dag. Det ændrer kun, hvad man skal holde øje med: om lokale AI-modeller på meget små Apple-enheder bevæger sig fra hobbyprojekt til reel softwareidé.
Det skal du holde øje med
Næste vigtige skridt er dokumentation, ikke større løfter. Hvis der kommer klare oplysninger om ydelse, strømforbrug og hvordan løsningen fungerer i praksis på Apple Watch, bliver demoen mere end en nørdet kuriositet og værd at tage alvorligt.