GyaanSetu AI

AI, machine learning en LLM-inzichten.

1515 articlesDeep, practical knowledge

180M-Parameter LLM Runs on a $10 ESP32-P4 Microcontroller

The p-for-llm project packs a 180.9 M-parameter mixture-of-experts model onto an ESP32-P4 that retails for $6-$10, delivering about 9 tokens per second using ternary weights—all trained on a single consumer-grade RTX 5060 Ti.

AI · 2 min read

Google versterkt Chrome met voormalig Relay-CEO om AI-agenten in de browser te brengen

Relay stopt de dienstverlening voor gratis gebruikers op 15 augustus en voor betalende klanten op 14 september, waarmee de AI-automatiseringdienst wordt beëindigd. Ondertussen is Jacob Bank, die voorheen verantwoordelijk was voor de producten Gmail, Calendar en Chat, nu VP van product en developer relations bij Chrome, waar hij de integratie van door Gemini aangedreven agenten leidt.

AI · 5 min read

Flock maakt invoer van zaaknummers verplicht na 46 meldingen van misbruik door agenten

De wijzigingen volgen op een onderzoek van de Washington Post, waaruit naar voren kwam dat agenten in 46 gevallen het netwerk van 120.000 camera's van Flock gebruikten voor persoonlijke stalking en andere ongeautoriseerde zoekopdrachten. Dit heeft het bedrijf ertoe aangezet om een invoerveld voor zaaknummers verplicht te stellen dat momenteel nog niet wordt gevalideerd.

AI · 3 min read

Kog Claims 30x Faster LLM Decoding on Existing Nvidia H200 GPUs

Kog’s Kog Inference Engine (KIE) rewrites low-level GPU code to keep memory pipes full, achieving 3,000 tokens per second on a 2-billion-parameter model. Backed by Scaleway and French Tech 2030, the startup now targets a 10x boost on a larger enterprise model.

AI · 5 min read