Reflection toont Beam voordat het de gewichten vrijgeeft

Het mixture-of-experts-model met 501 miljard parameters is alleen via vroege toegang beschikbaar. Volgens Reflection volgen de gewichten, een technisch rapport en ontwikkelaarstools later in oktober.

6 oktober 2026 · 3 min · Martin Seckar

Modellen adresseren feiten op volgorde van vermelding

Een preprint vindt een gedeelde interne richting die taalmodellen naar het eerste, tweede of latere feit in een passage wijst. Een vraag langs die richting verschuiven kan veranderen welk feit het model ophaalt.

6 oktober 2026 · 4 min · Martin Seckar

EasyCommand zet Engels lokaal om in Bash

De open-sourcetool voor de opdrachtregel bevat llama.cpp en levert twee kleine gefinetunede modellen mee. De auteur heeft ook de trainingsset met 401.975 paren en de benchmarkcode vrijgegeven.

6 oktober 2026 · 2 min · Martin Seckar

4MT-VLM: visiemodellen verliezen locaties na rotatie

Een preprint past een klinische test voor ruimtelijk geheugen aan voor 16 visietaalmodellen. Alle herkennen een landschap vanuit de bestudeerde hoek, maar de meeste vervallen tot gokken zodra de camera beweegt.

6 oktober 2026 · 6 min · Martin Seckar

bilibili breidt Index-Translate uit met lokale builds

De open vertaalfamilie heeft nu GGUF-, FP8- en NVFP4-pakketten, een gratis compatibele API en vier openbare benchmarks. De prestatiecijfers blijven eigen metingen van de ontwikkelaar.

5 oktober 2026 · 3 min · Martin Seckar

Voorbeelden versterken een symbolisch circuit dat al bestaat

Een onderzoek naar interpreteerbaarheid vindt hetzelfde pad voor abstractie, inductie en ophalen voordat de nauwkeurigheid met enkele voorbeelden stijgt. Dat suggereert dat demonstraties bestaande mechanismen versterken in plaats van een nieuw algoritme te bouwen.

5 oktober 2026 · 4 min · Martin Seckar

Strata-fork blaast IBM-AI-server nieuw leven in voor lokale LLM's

Een fork voor specifieke hardware draait Qwen3.8-Flash-Next op twee POWER9-processors en vier V100-GPU's. Dat laat zien wat modelbewuste optimalisatie uit een systeem uit 2018 kan halen.

5 oktober 2026 · 3 min · Martin Seckar

Wagtails maand met één model besteedde helft tokens elders

Een plan om in september al het ontwikkelwerk op GLM 5.3 Flash te doen, verbruikte twee miljard tokens, maar slechts de helft ging naar dat model. Prototypes, aanbiederscapaciteit en evaluatie verklaren het verschil.

5 oktober 2026 · 3 min · Martin Seckar

Aleph Alpha geeft Kolibri met open gewichten vrij

Het Duits-Engelse redeneermodel wordt geleverd met Apache-2.0-gewichten en instructies voor inferentie. Het kleine aantal actieve parameters laat de geheugenbehoefte nog altijd groot.

4 oktober 2026 · 3 min · Martin Seckar

Georgia Tech-team verlengt het volgen van modelverwijzingen

Een kleine getrainde ingreep verbetert Qwen3-8B sterk op synthetische verwijzingsketens. De preprint herleidt de verandering tot de manier waarop middelste lagen informatie tussen regels doorgeven.

4 oktober 2026 · 4 min · Martin Seckar