Modellen adresseren feiten op volgorde van vermelding

Een preprint vindt een gedeelde interne richting die taalmodellen naar het eerste, tweede of latere feit in een passage wijst. Een vraag langs die richting verschuiven kan veranderen welk feit het model ophaalt.

6 oktober 2026 · 4 min · Martin Seckar

Agents missen het verband tussen acties en uitkomsten

Een preprint vindt dat veel van het voordeel van de geschiedenis van een agent behouden blijft wanneer eerdere acties door elkaar worden gezet. Elke actie expliciet aan haar resultaat koppelen verbetert de taakvoltooiing.

6 oktober 2026 · 4 min · Martin Seckar

Contextmodellen laten agents hun eigen geschiedenis bewerken

Context Language Models vervangen een transcript waaraan alleen tekst wordt toegevoegd door een bestand dat het model kan herschrijven, wissen en herschikken. De auteurs melden hogere nauwkeurigheid bij lange taken met minder herhaald rekenwerk na training van het bewerkingsbeleid.

6 oktober 2026 · 4 min · Martin Seckar

Dagelijks AI-overzicht – 6 oktober 2026

Het overige AI-nieuws van vandaag gaat over een ongewoon hybride model, onderzoek naar ruimtelijk geheugen en eerlijkheid, metingen uit de gemeenschap, beveiligingsincidenten met agents, EU-watermerken en praktische lezingen.

6 oktober 2026 · 14 min · Martin Seckar

4MT-VLM: visiemodellen verliezen locaties na rotatie

Een preprint past een klinische test voor ruimtelijk geheugen aan voor 16 visietaalmodellen. Alle herkennen een landschap vanuit de bestudeerde hoek, maar de meeste vervallen tot gokken zodra de camera beweegt.

6 oktober 2026 · 6 min · Martin Seckar

Leugendetectieprobes volgen naleving in plaats van waarheid

Een preprint test acht gepubliceerde probes op taalmodellen die personages spelen die basisfeiten afwijzen. Veel falen zodra ware en onware antwoorden dezelfde prompt delen; een probe die waarheid van gehoorzaamheid leert scheiden, houdt stand.

6 oktober 2026 · 6 min · Martin Seckar

Signalen van zekerheid sturen modellen meer dan bekwaamheid

Een gecontroleerd onderzoek vindt dat één zin met zekerheid of twijfel sterk kan veranderen of een redeneermodel een tool aanroept. De veranderingen richten zich echter zelden op problemen waarbij hulp nodig is.

5 oktober 2026 · 4 min · Martin Seckar

Voorbeelden versterken een symbolisch circuit dat al bestaat

Een onderzoek naar interpreteerbaarheid vindt hetzelfde pad voor abstractie, inductie en ophalen voordat de nauwkeurigheid met enkele voorbeelden stijgt. Dat suggereert dat demonstraties bestaande mechanismen versterken in plaats van een nieuw algoritme te bouwen.

5 oktober 2026 · 4 min · Martin Seckar

Dagelijks AI-overzicht – 5 oktober 2026

Sprekerdiarisatie, artikelen over modelcognitie, lokale projecten, promptpraktijken, tests uit de gemeenschap en de veiligheids- en beleidsontwikkelingen van vandaag.

5 oktober 2026 · 17 min · Martin Seckar

Zous team volgt hoe modellen interne veranderingen melden

Een gecontroleerde preprint scheidt het detecteren van een activatieverandering van het melden van de locatie. Het experiment gebruikt vaste invoertekst en beoordeelt antwoorden zonder AI-beoordelaar.

4 oktober 2026 · 4 min · Martin Seckar

Georgia Tech-team verlengt het volgen van modelverwijzingen

Een kleine getrainde ingreep verbetert Qwen3-8B sterk op synthetische verwijzingsketens. De preprint herleidt de verandering tot de manier waarop middelste lagen informatie tussen regels doorgeven.

4 oktober 2026 · 4 min · Martin Seckar