EasyCommand zet Engels lokaal om in Bash

De open-sourcetool voor de opdrachtregel bevat llama.cpp en levert twee kleine gefinetunede modellen mee. De auteur heeft ook de trainingsset met 401.975 paren en de benchmarkcode vrijgegeven.

6 oktober 2026 · 2 min · Martin Seckar

Contextmodellen laten agents hun eigen geschiedenis bewerken

Context Language Models vervangen een transcript waaraan alleen tekst wordt toegevoegd door een bestand dat het model kan herschrijven, wissen en herschikken. De auteurs melden hogere nauwkeurigheid bij lange taken met minder herhaald rekenwerk na training van het bewerkingsbeleid.

6 oktober 2026 · 4 min · Martin Seckar

vLLM toont wanneer gescheiden inferentie helpt en hindert

Een praktische gids meet de afweging bij het scheiden van promptverwerking en tokengeneratie. Hoge latenties verbeteren onder belasting, maar het verplaatsen van het werkgeheugen van het model vertraagt het eerste token.

6 oktober 2026 · 3 min · Martin Seckar

Dagelijks AI-overzicht – 6 oktober 2026

Het overige AI-nieuws van vandaag gaat over een ongewoon hybride model, onderzoek naar ruimtelijk geheugen en eerlijkheid, metingen uit de gemeenschap, beveiligingsincidenten met agents, EU-watermerken en praktische lezingen.

6 oktober 2026 · 14 min · Martin Seckar

bilibili breidt Index-Translate uit met lokale builds

De open vertaalfamilie heeft nu GGUF-, FP8- en NVFP4-pakketten, een gratis compatibele API en vier openbare benchmarks. De prestatiecijfers blijven eigen metingen van de ontwikkelaar.

5 oktober 2026 · 3 min · Martin Seckar

Wagtails maand met één model besteedde helft tokens elders

Een plan om in september al het ontwikkelwerk op GLM 5.3 Flash te doen, verbruikte twee miljard tokens, maar slechts de helft ging naar dat model. Prototypes, aanbiederscapaciteit en evaluatie verklaren het verschil.

5 oktober 2026 · 3 min · Martin Seckar

Aleph Alpha geeft Kolibri met open gewichten vrij

Het Duits-Engelse redeneermodel wordt geleverd met Apache-2.0-gewichten en instructies voor inferentie. Het kleine aantal actieve parameters laat de geheugenbehoefte nog altijd groot.

4 oktober 2026 · 3 min · Martin Seckar

Mingbird voegt vaardigheden toe aan zijn lokale agentomgeving

Het project op basis van Ollama voegt spraakinvoer en tools voor dagelijks documentwerk toe. De gepubliceerde benchmark stelt dat resultaten van kleine modellen sterk van de omringende software afhangen.

4 oktober 2026 · 3 min · Martin Seckar

Kevin Liao stelt agentgeheugen op basis van documenten voor

De workflow van de ontwikkelaar bewaart specificaties en besluiten in bewerkbare Markdown. Zijn betoog gaat samen met een open-sourceimplementatie, maar zonder vergelijkende benchmark.

4 oktober 2026 · 3 min · Martin Seckar