veilletech.fr
18 sept.

Source · 31 jours de veille

Latent Space

Ce qui a été retenu de cette source, et sur quels thèmes. Chaque fiche est une synthèse originale et renvoie à l'article d'origine.

2fiches
2jours sur 31
7min de lecture
IA & LLMthème

DeepSeek sépare le prefill du décodage

DeepSeek a publié V4.1-Flash sous licence MIT sur Hugging Face, avec la vision intégrée au modèle. L'architecture est un encodeur-décodeur causal qui sépare le prefill du décodage : environ 8 milliards de paramètres actifs sur l'entrée, 16 sur la sortie. Le laboratoire annonce un cache clés-valeurs 4× plus léger en HBM et 8× sur SSD que la génération précédente — mais le décompte total, entre les 552 milliards annoncés et les ~763 trouvés dans les fichiers publiés, reste disputé.

13 sept.3 min

LLM

Le harnais des agents fond dans le modèle

Une analyse de Latent Space explique le basculement de fin 2025 par le croisement de deux courbes : celle des modèles et celle du harnais qui les entoure. Sa thèse est que les modèles absorbent progressivement ce harnais dans leurs poids, ce qui rend jetable une grande partie de l'échafaudage que les équipes écrivent aujourd'hui.

23 août4 min

IA