Test sur un corpus de rapports de programme : ce que l'outil fait bien, ce qu'il rate, et où la relecture humaine reste obligatoire.
Nous avons soumis un corpus de neuf rapports de programme à NotebookLM et comparé le résultat à la note de synthèse rédigée par un chargé de programme expérimenté.
La couverture. Aucun des documents n'est survolé, y compris les annexes que la lecture humaine laisse habituellement de côté. Le croisement d'informations dispersées entre plusieurs rapports est également plus systématique.
La hiérarchisation. L'outil traite au même niveau une décision structurante et une remarque de bas de page. Il ne sait pas non plus ce qui est politiquement sensible dans un contexte donné, et c'est souvent l'essentiel d'une note de synthèse.
L'outil trouve tout et ne sait pas ce qui compte. C'est exactement l'inverse d'un bon rédacteur.