Aller au contenu

Audiogami : transformer la voix en données structurées

Origine et contexte

Le projet part d'un constat terrain récurrent dans les missions d'accompagnement Memoways : des dirigeants et des experts excellent à l'oral, mais peinent face aux interfaces des bases de données. Chez Bord Cadre films, le directeur — un « super communicateur » — n'utilisait pas les outils mis en place : sa modalité naturelle, la voix, n'y trouvait pas sa place. Quand l'information importante reste bloquée chez une personne, toute l'organisation ralentit.

Le nom du projet fusionne « audio » et « origami » : comme l'art japonais transforme une simple feuille en œuvre par des plis précis, Audiogami plie les paroles spontanées en données structurées.

« Entrer des données dans une base de données, c'est partir d'une page blanche. Ce qu'on doit faire est facile à faire parce que c'est pré-plié — de manière ludique et "organique", on suit simplement une procédure, par les pliages. Après, on a un petit objet qui se révèle "magiquement" et qui a une valeur. » — Ulrich Fischer, live Open Research, juin 2025

Ce qui a été réalisé ensemble

Générations de plusieurs prototypes, une API dédiée, des démonstrateurs et un widget (”La plage”) — chaque itération documentée publiquement en open research.

Voir le déroulé détaillé
Voir le détailRéduire
  1. Applications natives d'enregistrement — face à l'explosion de choix après l'enregistrement (email, WhatsApp, Notion…), abandon systématique des testeurs.
  2. Automatisation cloud (n8n : Drive → Whisper → GPT-4 → Airtable) — architecture élégante, mais un décalage de quelques minutes entre la dictée et le retour suffit à faire abandonner.
  3. Interface Telegram — familiarité immédiate et feedback instantané : adoption au rendez-vous.
  4. Mi-2025 : première version de l'API dédiée (Gamilab) — la complexité n8n est remplacée par une seule brique technologique, avec validation humaine optimisée.
  5. Nov.–déc. 2025 : trois démonstrateurs vibe-codés (Bolt, Lovable) pour tester l'expérience de correction en temps réel ; landing page audiogami.com générée en moins de 10 heures.
  6. Déc. 2025 : widget « La Plage » — transcription mot à mot en direct, structuration en tâches sous les yeux de l'utilisateur, gamification origami, le tout propulsé par des Small Language Models hébergés en Suisse.

Contribution de Memoways

Le constat terrain et la méthode : expérimentation publique en open research, 15 entretiens de customer discovery, prototypes no-code et démonstrateurs, contenus et communauté. L'ingénierie bas niveau — API, SLM, widget, hébergement — est l'œuvre de Gamilab. Le résultat est collectif, et cette page ne l'attribue à personne en particulier.

Artefacts et preuves

État et suite

Depuis le printemps 2026, le projet se poursuit sous l'appellation Gamilab, société qui héberge aussi les projets cousins (Edugami, Storygami). Cette page reste comme trace de la phase de genèse — des nouvelles arrivent tout prochainement.

Audiogami — Voice-to-Structured-Data for No-CodeAudiogami turns speech into validated structured data for business apps, CRMs, Notion, Airtable and Google Sheets with a Swiss-hosted SDK and API.audiogami.com

Preuve de niveau qualitatif : 15 entretiens de customer discovery et observations d'adoption documentées.

Limites et apprentissages

La sophistication technique ne compense jamais la friction cognitive ; le feedback immédiat prime sur la perfection fonctionnelle ; l'interface familière bat l'interface optimale. Simplicité, flexibilité et précision restent une quadrature du cercle. Et un démonstrateur convaincant reste un démonstrateur — pas encore un produit.

Prochaine étape

Vous avez des informations qui se perdent entre la voix et vos outils ?