Strata-fork blaast IBM-AI-server nieuw leven in voor lokale LLM's

Een fork voor specifieke hardware draait Qwen3.8-Flash-Next op twee POWER9-processors en vier V100-GPU's. Dat laat zien wat modelbewuste optimalisatie uit een systeem uit 2018 kan halen.

5 oktober 2026 · 3 min · Martin Seckar

Wagtails maand met één model besteedde helft tokens elders

Een plan om in september al het ontwikkelwerk op GLM 5.3 Flash te doen, verbruikte twee miljard tokens, maar slechts de helft ging naar dat model. Prototypes, aanbiederscapaciteit en evaluatie verklaren het verschil.

5 oktober 2026 · 3 min · Martin Seckar

Matthew Green: agentsandboxen hebben een bewaker nodig

De cryptograaf stelt dat afscherming nodig blijft, maar het moeilijkste deel van agentbeveiliging niet kan oplossen: bepalen welke informatie en instructies geautoriseerd zijn.

5 oktober 2026 · 3 min · Martin Seckar

Dagelijks AI-overzicht – 5 oktober 2026

Sprekerdiarisatie, artikelen over modelcognitie, lokale projecten, promptpraktijken, tests uit de gemeenschap en de veiligheids- en beleidsontwikkelingen van vandaag.

5 oktober 2026 · 17 min · Martin Seckar

Aleph Alpha geeft Kolibri met open gewichten vrij

Het Duits-Engelse redeneermodel wordt geleverd met Apache-2.0-gewichten en instructies voor inferentie. Het kleine aantal actieve parameters laat de geheugenbehoefte nog altijd groot.

4 oktober 2026 · 3 min · Martin Seckar

Zous team volgt hoe modellen interne veranderingen melden

Een gecontroleerde preprint scheidt het detecteren van een activatieverandering van het melden van de locatie. Het experiment gebruikt vaste invoertekst en beoordeelt antwoorden zonder AI-beoordelaar.

4 oktober 2026 · 4 min · Martin Seckar

Georgia Tech-team verlengt het volgen van modelverwijzingen

Een kleine getrainde ingreep verbetert Qwen3-8B sterk op synthetische verwijzingsketens. De preprint herleidt de verandering tot de manier waarop middelste lagen informatie tussen regels doorgeven.

4 oktober 2026 · 4 min · Martin Seckar

Mingbird voegt vaardigheden toe aan zijn lokale agentomgeving

Het project op basis van Ollama voegt spraakinvoer en tools voor dagelijks documentwerk toe. De gepubliceerde benchmark stelt dat resultaten van kleine modellen sterk van de omringende software afhangen.

4 oktober 2026 · 3 min · Martin Seckar

Kevin Liao stelt agentgeheugen op basis van documenten voor

De workflow van de ontwikkelaar bewaart specificaties en besluiten in bewerkbare Markdown. Zijn betoog gaat samen met een open-sourceimplementatie, maar zonder vergelijkende benchmark.

4 oktober 2026 · 3 min · Martin Seckar

Simon Willison wil standaard bestedingslimieten voor agents

Zijn voorstel kiest voor automatisch stoppen bij een budgetgrens. De limiet verwijderen zou een expliciete keuze vereisen.

4 oktober 2026 · 2 min · Martin Seckar