veilletech.fr
5 sept. Feed du jour
#09 OUTILS Article

Apache Maka publie ses scores, pas ses promesses

Un harnais qui publie ses scores plutôt que ses promesses.

Apache Maka, en incubation à l'ASF, est un harnais d'agent qui se juge sur une seule mesure : le nombre de tâches terminées et leur coût, comparé aux autres harnais sur le même modèle avec le vérificateur officiel, résultats par tâche publiés. Son principe de conception est que le journal est le runtime — chaque message, appel d'outil et décision de permission est un RuntimeEvent append-only dont l'interface et le prompt suivant ne sont que des projections. Tout reste local et le modèle est le vôtre.

3 min de lectureintermédiairevidéo 1:18
Partager
Sommaire4 sections
  1. Ce qui se passe
  2. Le principe de conception : le journal est le runtime
  3. Ce que ça change
  4. À retenir

Ce qui se passe

Apache Maka (Incubating) est un espace de travail pour agents IA, sous licence Apache 2.0. Sa présentation tient en une phrase revendiquée : un harnais d'agent existe pour terminer des tâches, et se juge à combien il en termine, et à quel coût.

Le projet en tire une règle qu'on voit rarement affichée : « mesuré, pas revendiqué ». Les comparaisons se font contre d'autres harnais sur le même modèle, avec le vérificateur officiel du banc d'essai, et les résultats détaillés par tâche sont livrés dans le dépôt (docs/eval/) avec chaque rapport.

Le principe de conception : le journal est le runtime

C'est l'idée structurante. Chaque message du modèle, chaque appel d'outil, chaque décision d'autorisation et chaque terminaison est un RuntimeEvent écrit en ajout seul. L'interface, la construction du prompt suivant et la reprise après plantage sont des projections de ce journal — jamais la seule copie de l'information.

Un détail en dit long sur le sérieux de la conception : une sortie d'outil ancienne peut quitter le prompt suivant sans quitter le journal. Autrement dit, l'élagage du contexte n'est pas une perte de trace. C'est exactement ce qui manque quand on cherche à comprendre après coup ce qu'un agent a fait, et pourquoi.

Le reste suit :

Ce que ça change

Deux choses, pour qui construit ou évalue de l'outillage d'agent.

D'abord le format de journal, qui vaut d'être regardé même si l'on n'adopte pas l'outil : traiter l'affichage comme une projection d'un journal en ajout seul règle d'un coup l'auditabilité, la reprise après plantage et la gestion du contexte, qui sont d'ordinaire trois mécanismes séparés qui se contredisent.

Ensuite le module d'évaluation, qui rend mesurable une question habituellement tranchée à l'impression : est-ce que ce changement de configuration améliore quelque chose ? Sur des exécutions comparables, avec le même modèle et un vérificateur officiel, la réponse cesse d'être une intuition.

À retenir

La réserve est nette et le projet ne la cache pas. Aucune release Apache n'a encore été publiée. Ce qui est distribué, ce sont des constructions de nuit issues de main : macOS Intel et Apple Silicon, Windows x64, Linux x64 et arm64 — les builds Windows et Linux étant des préversions non signées. Le dépôt précise que ce n'est pas une release ASF et que ce n'est pas destiné à la production.

Pour compiler depuis les sources, il faut Node.js 22.19 ou plus (la CI utilise Node.js 24), npm 11, Git et ripgrep, dont se sert l'outil Grep :

Terminal
git clone https://github.com/apache/maka.git
cd maka
npm ci
npm run dev

Les fonctionnalités Direct Peer et Peer Mesh demandent en plus Rust stable 1.98 ou supérieur et le linker de la plateforme.

Source : Apache Maka