Strata-fork blaast IBM-AI-server nieuw leven in voor lokale LLM's
Een fork voor specifieke hardware draait Qwen3.8-Flash-Next op twee POWER9-processors en vier V100-GPU's. Dat laat zien wat modelbewuste optimalisatie uit een systeem uit 2018 kan halen.