Reflection toont Beam voordat het de gewichten vrijgeeft

Het mixture-of-experts-model met 501 miljard parameters is alleen via vroege toegang beschikbaar. Volgens Reflection volgen de gewichten, een technisch rapport en ontwikkelaarstools later in oktober.

6 oktober 2026 · 3 min · Martin Seckar

Agents missen het verband tussen acties en uitkomsten

Een preprint vindt dat veel van het voordeel van de geschiedenis van een agent behouden blijft wanneer eerdere acties door elkaar worden gezet. Elke actie expliciet aan haar resultaat koppelen verbetert de taakvoltooiing.

6 oktober 2026 · 4 min · Martin Seckar

Contextmodellen laten agents hun eigen geschiedenis bewerken

Context Language Models vervangen een transcript waaraan alleen tekst wordt toegevoegd door een bestand dat het model kan herschrijven, wissen en herschikken. De auteurs melden hogere nauwkeurigheid bij lange taken met minder herhaald rekenwerk na training van het bewerkingsbeleid.

6 oktober 2026 · 4 min · Martin Seckar

Dagelijks AI-overzicht – 6 oktober 2026

Het overige AI-nieuws van vandaag gaat over een ongewoon hybride model, onderzoek naar ruimtelijk geheugen en eerlijkheid, metingen uit de gemeenschap, beveiligingsincidenten met agents, EU-watermerken en praktische lezingen.

6 oktober 2026 · 14 min · Martin Seckar

Signalen van zekerheid sturen modellen meer dan bekwaamheid

Een gecontroleerd onderzoek vindt dat één zin met zekerheid of twijfel sterk kan veranderen of een redeneermodel een tool aanroept. De veranderingen richten zich echter zelden op problemen waarbij hulp nodig is.

5 oktober 2026 · 4 min · Martin Seckar

Matthew Green: agentsandboxen hebben een bewaker nodig

De cryptograaf stelt dat afscherming nodig blijft, maar het moeilijkste deel van agentbeveiliging niet kan oplossen: bepalen welke informatie en instructies geautoriseerd zijn.

5 oktober 2026 · 3 min · Martin Seckar

Mingbird voegt vaardigheden toe aan zijn lokale agentomgeving

Het project op basis van Ollama voegt spraakinvoer en tools voor dagelijks documentwerk toe. De gepubliceerde benchmark stelt dat resultaten van kleine modellen sterk van de omringende software afhangen.

4 oktober 2026 · 3 min · Martin Seckar

Kevin Liao stelt agentgeheugen op basis van documenten voor

De workflow van de ontwikkelaar bewaart specificaties en besluiten in bewerkbare Markdown. Zijn betoog gaat samen met een open-sourceimplementatie, maar zonder vergelijkende benchmark.

4 oktober 2026 · 3 min · Martin Seckar

Simon Willison wil standaard bestedingslimieten voor agents

Zijn voorstel kiest voor automatisch stoppen bij een budgetgrens. De limiet verwijderen zou een expliciete keuze vereisen.

4 oktober 2026 · 2 min · Martin Seckar