veilletech.fr
18 sept.

Source · 31 jours de veille

Hugging Face

Ce qui a été retenu de cette source, et sur quels thèmes. Chaque fiche est une synthèse originale et renvoie à l'article d'origine.

3fiches
3jours sur 31
9min de lecture
IA & LLM · Web & Frontthèmes

Votre agent a réussi. Recommencera-t-il ?

Une équipe d'IBM Research mesure l'écart entre la réussite moyenne d'un agent et sa réussite reproductible : sur AppWorld test_normal, un agent ReAct avec GPT-4.1 affiche 77,4 % en Mean@5 mais seulement 53,0 % en Pass^5, soit 24,4 points d'écart, à température 0. Leur Consistency Analyzer rejoue chaque point de décision d'une trace enregistrée pour repérer ceux qui sont à un tirage de basculer, et les consignes qui en découlent ramènent l'écart à 12,0 points.

16 sept.4 min

IA

207 kernels WebGPU pour le navigateur

Hugging Face publie @huggingface/kernels et 207 kernels WebGPU versionnés sur le Hub, chacun livré avec manifeste, tests de correction, benchmarks et shaders WGSL. Face à ONNX Runtime Web sur un M4, les kernels sont 2,57× plus rapides en moyenne géométrique sur 809 cas comparables.

2 sept.2 min

WEB

Multi-vecteur : Sentence Transformers s’y met

Sentence Transformers v6 introduit MultiVectorEncoder et toute la chaîne d'entraînement pour les modèles à interaction tardive façon ColBERT. La démonstration atteint 0,9139 de NDCG@10 sur un corpus médical, contre 0,7817 pour un modèle dense de 4 milliards de paramètres — sur une seule RTX 3090.

27 août3 min

RAG