×
Accueil Tutoriels Infos Geeks Bons Plans Cybersécurité Contact Demander de l’aide
Meeting Recorder : vos visios transcrites en local sous Omarchy Productivité & Automatisation

Meeting Recorder : vos visios transcrites en local sous Omarchy

26 Sep 2026 •

Meeting Recorder : la transcription locale visio qui ne passe pas par le cloud

La transcription locale visio, c’est le sujet qui revient toutes les trois semaines dans mon atelier. Un client me demande, la bouche en coeur : « Marc, tu peux me trouver un truc qui écrit ce qui se dit en réunion sans que ça part chez Google ? » Et là, généralement, je soupire. Parce que pendant dix ans, la réponse honnête était : « Non, ou alors tu passes tes nuits à configurer ffmpeg. » Autant dire que la sortie de Meeting Recorder sous Omarchy, mine de rien, change un peu la donne.

Omarchy, pour les distraits, c’est la distribution Arch montée par DHH. Oui, le type de Basecamp. Le bonhomme a décidé que son temps était trop précieux pour réinstaller un environnement graphique tous les six mois, alors il a figé le sien dans une ISO. Résultat : une Arch qui ne t’explose pas à la figure à chaque mise à jour. Et dessus, il y a maintenant un outil qui enregistre tes visios, sépare ta voix de celle des autres, et transcrit tout en local. Sans bot qui s’annonce dans la réunion. Sans données qui partent à l’autre bout du monde.

Je ne suis pas certain à 100% que ce soit la solution miracle que tout le monde attend, mais d’après mon expérience en atelier, c’est la première fois qu’un outil de ce genre est livré clé en main sur une distro grand public. Et ça, ça mérite qu’on s’y attarde.

Deux pistes, zéro bot : le vrai tour de force technique

Ce qui m’a fait lever un sourcil, c’est l’architecture audio. La plupart des enregistreurs de visio que j’ai testés ces cinq dernières années font la même chose : ils capturent la sortie son de ton système, point. Résultat, ta voix et celle de tes interlocuteurs sont mélangées dans un seul flux. Ensuite, tu passes trois heures à essayer de deviner qui a dit quoi dans un transcript de 40 pages.

Meeting Recorder fait autrement. Il enregistre deux pistes distinctes : une pour ton micro, une pour tout ce qui sort du système. Donc quand tu utilises une transcription locale visio, chaque locuteur reste identifiable sans avoir besoin d’un modèle de diarisation lourd. C’est bête comme chou, mais fallait y penser. Et surtout, fallait l’implémenter proprement sous PipeWire, ce qui n’est pas un exercice de débutant.

Pourquoi ça change tout pour la relecture

La semaine dernière, un client avocat m’appelle. Il enregistre ses visios avec des confrères, puis il doit retrouver des passages précis dans des réunions d’une heure et demie. Avec une piste unique, il passe son temps à réécouter. Avec deux pistes séparées, il sait immédiatement si c’est lui ou son interlocuteur qui a lâché la phrase litigieuse. Du coup, le gain de temps est réel, pas juste marketing.

Parlons du bot. Sur Teams, Zoom ou Meet, quand tu ajoutes un assistant qui rejoint la réunion, tout le monde le voit. Et dans certains contextes — négociation, entretien, réunion RH — ça refroidit l’ambiance. Meeting Recorder ne rejoint rien du tout. Il se contente de capter ce qui passe sur ta machine. Pour être honnête, c’est la seule approche qui tient debout si tu veux que les gens se comportent normalement en visio.

Whisper en local, et l’IA seulement pour les chapitres

Là où le projet devient intéressant, c’est dans la répartition des tâches. La transcription brute passe par whisper, en local, sur ton processeur. Pas d’API, pas de facture à la minute, pas de fuite. Tu lances, tu attends, tu récupères ton texte. Ça peut prendre du temps sur une vieille machine — on y revient — mais ça ne coûte rien et ça ne sort pas de chez toi.

En revanche, pour les chapitres, Meeting Recorder délègue à l’agent IA que tu as configuré dans Omarchy. C’est un choix que je trouve discutable sur le principe, mais pragmatique dans les faits. Générer des chapitres pertinents, c’est un boulot de synthèse qui demande un vrai modèle de langage. Whisper ne sait pas faire ça. Donc soit tu acceptes que cette étape parte ailleurs, soit tu n’as pas de chapitres.

Mon avis tranché sur cette histoire d’agent

Je vais être direct : je pense que c’est une erreur de com’. Beaucoup d’utilisateurs vont lire « tout en local » et comprendre « absolument tout en local ». Ce n’est pas le cas. Les chapitres, c’est la cerise sur le gâteau, et cette cerise passe par ton agent configuré. Si tu l’as branché sur un modèle hébergé, tes chapitres partent chez un tiers. Si tu l’as branché sur Ollama, tout reste chez toi.

Donc techniquement, la promesse tient. Mais il faut lire la doc en entier, pas juste le titre. Et ça, dans mon métier, c’est 80% des problèmes que je rencontre. Les gens installent, cliquent, et s’étonnent après.

Le bug AVX-512 qui fâche, et pourquoi ça ne m’étonne pas

Alors voilà le point qui fâche. La version 1.1.1 plante sur les processeurs sans AVX-512. Traduction pour les non-informaticiens : si ton CPU date d’avant 2017 environ, ou si tu es chez AMD sur certaines générations, tu es dans le mur. Le binaire compile avec des instructions que ta machine ne comprend pas, et ça se termine par un joli crash au lancement.

J’ai vu ce bug des dizaines de fois. Ce n’est pas propre à Meeting Recorder, c’est un classique des projets qui optimisent pour les machines de développeurs. Le dev a un Threadripper flambant neuf, il compile avec les flags natifs, et il ne se rend pas compte que 60% de ses utilisateurs ont un CPU de 2015. Du coup, il livre un binaire qui ne tourne que chez lui et chez trois copains.

Ce que tu peux faire en attendant

Si tu tombes sur ce crash, tu n’es pas totalement coincé. Voici les pistes que je donnerais à un client dans cette situation :

  • Vérifier ton CPU avec lscpu | grep avx512 — si rien ne sort, tu es concerné
  • Compiler depuis les sources avec un flag générique plutôt que natif
  • Attendre une 1.1.2 qui devrait corriger le tir — c’est en général ce qui se passe
  • Signaler le bug sur le dépôt si personne ne l’a encore fait

Je ne suis pas certain que la compilation manuelle soit à la portée de tout le monde, mais pour un utilisateur d’Arch qui a déjà installé Omarchy, on n’est pas dans l’exploit. Mine de rien, c’est le revers de la médaille d’une distro qui cible les gens à l’aise avec un terminal.

Faut-il se jeter dessus ? Mon verdict de technicien

Alors, est-ce que je recommande Meeting Recorder à mes clients ? Ça dépend. Si tu es sous Omarchy, que tu as un CPU récent, et que tu veux une transcription locale visio sans te prendre la tête, oui, sans hésiter. Le gain par rapport à un setup ffmpeg + whisper manuel est énorme. Tu lances, tu oublies, tu récupères ton texte et tes chapitres.

Si tu es sur une machine de 2016 ou que tu ne veux pas entendre parler d’agents IA, attends la prochaine version. Le bug AVX-512 va sauter, c’est une évidence. Et pour l’agent, tu peux toujours le configurer en local si tu as un GPU correct.

Ce qui me plaît dans ce projet, c’est la direction. On arrête de faire croire que la transcription doit passer par un SaaS à 20 dollars par mois. On arrête de foutre des bots dans les réunions. On sépare les pistes audio comme un adulte. Pour être honnête, il était temps que quelqu’un s’y colle proprement.

Et évidemment, pendant ce temps, Windows a encore tout cassé avec une mise à jour qui coupe le micro au bout de 30 secondes. Autant dire que je ne suis pas près de conseiller à mes clients de retourner sur Teams pour enregistrer leurs réunions. La transcription locale visio, c’est l’avenir, et il se joue sur Linux pour l’instant.

Les détails techniques que personne ne lit, mais qui comptent

Trois choses que je veux préciser avant de te laisser tester, parce que ce sont les questions qu’on me pose systématiquement après une install.

Le stockage. Deux pistes audio plus un transcript, ça monte vite. Une réunion d’une heure en qualité correcte, c’est facile 300 Mo de WAV. Prévois de la place, et pense à archiver ailleurs que sur ton SSD système.

La qualité du micro. Whisper est bon, mais pas magicien. Si ton micro crache du bruit de fond, la transcription va inventer des mots. J’ai un client qui transcrivait ses visios avec un casque à 15 euros, il récupérait des phrases qui n’existaient pas. Investis dans un micro décent, tu gagneras plus qu’en changeant de logiciel.

Le temps de traitement. Sur un CPU sans AVX-512 — quand ça marchera — compte facilement le double du temps réel. Une réunion d’une heure peut prendre deux heures à transcrire. Lance ça le soir, pas cinq minutes avant d’envoyer le compte-rendu.

Voilà. Le projet vit sur le billet de Korben, qui détaille l’installation et les dépendances. Si tu es sous Omarchy, ça vaut le détour. Si tu es ailleurs, ce n’est pas encore pour toi, mais garde un oeil dessus. Ce genre d’outil finit toujours par essaimer.

Source : article original

🔗 Nos autres sites :
Please follow and like us:
Pin Share
Un projet Paradoxe  —  Vous êtes entre de bonnes mains. Huit, exactement.