Advertentie
Een Reddit-gebruiker heeft een opvallende draagbare AI-robot gebouwd in een reiskoffer. Het project, dat de naam Sparky kreeg, draait volledig lokaal op een Nvidia Jetson Orin NX Super 16GB en werkt zonder internetverbinding of cloudtoegang.
De maker omschrijft Sparky als een “offline suitcase robot” met een uitgesproken persoonlijkheid en opvallende googly eyes. De robot gebruikt Google’s Gemma 4 E4B-taalmodel en reageert volgens de ontwikkelaar binnen ongeveer 200 milliseconden.
AI-assistent draait volledig lokaal
Sparky werd gebouwd door Reddit-gebruiker “CreativelyBankrupt”, die het project deelde op de subreddit r/LocalLLaMA. In tegenstelling tot veel commerciële AI-assistenten verwerkt de robot alle taken lokaal op de ingebouwde hardware.
De basis bestaat uit een Nvidia Jetson Orin NX Super 16GB, een compacte AI-computer die populair is voor edge AI-projecten en robotica.
Volgens de maker draait Sparky:
Gemma 4 E4B via llama.cpp met een Q4_K_M-quantisatie, een q8_0 KV-cache, flash Attention-ondersteuning en een contextvenster van 12.000 tokens.
Daardoor kan de robot gesprekken onthouden en relatief vloeiend reageren zonder verbinding met externe servers.
Meer dan 30 sensoren
De AI-koffer bevat daarnaast meer dan dertig sensoren om zijn omgeving waar te nemen. Daardoor kan Sparky context uit de echte wereld verwerken terwijl hij mobiel gebruikt wordt.
Welke sensoren exact aanwezig zijn, werd niet volledig gespecificeerd, maar in de demonstratievideo reageert de robot onder meer op gesprekken en bewegingen rondom hem.
De spraakfunctionaliteit bestaat uit SenseVoiceSmall voor speech-to-text en Piper voor text-to-speech. Als bonus krijg je daarnaast een geanimeerd gezicht via PixiJS
De mondanimatie wordt volgens de maker 43 keer per seconde bijgewerkt om de spraak realistischer te laten ogen.Reactiesnelheid van ongeveer 200 ms
Opvallend is de relatief lage latency van het systeem. Sparky zou een zogenaamde Time To First Token van ongeveer 200 milliseconden halen. Dat betekent dat het systeem erg snel kan beginnen met antwoorden formuleren.
Daarna genereert de robot volgens de ontwikkelaar ongeveer 14 à 15 tokens per seconde.
Naast spraak kan de gebruiker de AI ook bedienen via een rij fysieke knoppen, een joystick en een analoge draaiknop.
Community reageert enthousiast
De maker deelde het project oorspronkelijk om advies te vragen over verdere optimalisatie van Gemma 4 op Nvidia Orin-hardware. De reacties op Reddit gingen echter vooral over het opvallende ontwerp en de persoonlijkheid van de robot.
Gebruikers omschrijven het project onder meer als “cute”, “adorable” en “kitsch”, al blijkt uit de demo’s ook dat Sparky behoorlijk eigenzinnige antwoorden geeft.
Het project toont tegelijk hoe krachtig compacte AI-hardware geworden is. Dankzij systemen zoals Nvidia’s Jetson-platform wordt het steeds eenvoudiger om relatief geavanceerde taalmodellen volledig lokaal te draaien, zonder afhankelijkheid van cloudinfrastructuur.