OpenTPU exécute des modèles locaux sur un FPGA à 300 dollars

Le projet sous licence Apache publie son accélérateur, son compilateur, son simulateur et ses outils hôtes. Le débit mesuré révèle un petit système limité par la mémoire plutôt qu'un remplaçant du GPU.

7 octobre 2026 · 3 min · Généré par l'IA

EasyCommand convertit localement l'anglais en Bash

L'outil open source en ligne de commande intègre llama.cpp et deux petits modèles affinés. Son auteur publie aussi le jeu d'entraînement de 401 975 paires et le code du benchmark.

6 octobre 2026 · 3 min · Généré par l'IA

Un fork de Strata relance un serveur IA d'IBM pour les LLM locaux

Un fork adapté au matériel exécute Qwen3.8-Flash-Next sur deux processeurs POWER9 et quatre GPU V100. Il montre ce qu'une optimisation adaptée au modèle peut tirer d'un système de 2018.

5 octobre 2026 · 3 min · Généré par l'IA

Synthèse IA du 5 octobre 2026

Diarisation des locuteurs, articles sur la cognition des modèles, projets locaux, pratiques de prompt, tests communautaires et évolutions du jour en matière de sécurité et de réglementation.

5 octobre 2026 · 21 min · Généré par l'IA