lipsapp
Nous contacter

Bientôt sur iOS et macOS

Lire la parole.
Sans un son.

Lipsapp regarde vos lèvres et écrit ce que vous dites. Pas de microphone, pas de serveur : la lecture se calcule sur votre iPhone ou votre Mac, en moins d’une seconde.

lecture des lèvres25 img/s · 0 micro

    0microphone pendant la lecture
    100 %du calcul sur l’appareil
    88 pxde bouche : le modèle ne voit rien d’autre
    < 1 spour reconnaître une commande sur Mac

    Image par image

    Faites-le parler.

    Faites défiler : votre scroll fait bouger de vraies lèvres, filmées puis réduites à leurs contours, à 25 images par seconde, comme le modèle les voit.

    Fonctionnement

    Cinq gestes entre vos lèvres et le texte.

    01

    Filmer, sans enregistrer le son

    La caméra avant suit votre visage à 25 images par seconde. Le microphone reste fermé : Lipsapp n’en a pas besoin pour lire.

    02

    Cadrer la bouche

    Cinq repères (yeux, nez, commissures) alignent le visage sur une référence fixe. Même si vous bougez la tête, la bouche arrive toujours au même endroit.

    03

    Réduire à l’essentiel

    Chaque image devient un carré gris de 88 × 88 pixels centré sur les lèvres. C’est tout ce que le modèle reçoit : ni le décor, ni votre voix.

    04

    Lire le mouvement

    Un réseau visuel transforme la séquence en mots, et propose plusieurs hypothèses avec leur probabilité. Pour piloter un ordinateur, il compare vos lèvres à la liste des commandes et rejette ce qui ne ressemble à aucune.

    05

    Apprendre vos lèvres

    Un petit adaptateur personnel (LoRA) s’entraîne sur vos propres prises, sur l’appareil. Il n’est gardé que s’il fait nettement mieux que le modèle général sur des phrases qu’il n’a jamais vues.

    Accessibilité d’abord

    Quand la voix manque,
    les lèvres parlent encore.

    Aphonie, laryngectomie, trachéotomie, maladie neuromusculaire, surdité, milieu où l’on ne peut pas parler fort : Lipsapp transforme une articulation silencieuse en texte, en commande ou en voix.

    Fonctionne aujourd’hui

    Piloter son Mac avec les lèvres

    Comme le Contrôle vocal d’Apple, mais sans vocaliser. Articulez « ouvrir Safari », « afficher les numéros » puis « numéro sept », « écrire » puis votre phrase. Chaque action sensible attend « confirmer » : rien ne part par erreur.

    • Toutes vos applications installées, ouvertes par leur nom
    • Un numéro sur chaque bouton, lien et champ de la fenêtre active
    • Défilement, onglets, clics, touches, dictée de texte
    • Fin de phrase détectée quand la bouche se ferme

    En préparation

    Retrouver sa voix

    Les mots lus sur les lèvres sont prononcés par une voix de synthèse. Avec quelques minutes d’anciens enregistrements, cette voix peut ressembler à la vôtre. Pour les personnes privées de voix après une opération ou une maladie.

    Fonctionne aujourd’hui

    Parler en silence

    Articulez sans émettre de son : l’iPhone écrit la phrase, la copie et la partage. Utile à l’hôpital, dans un open space, dans les transports, ou quand parler fatigue.

    En préparation

    Un appui à la lecture labiale

    Pour les personnes sourdes ou malentendantes qui lisent déjà sur les lèvres : une proposition de texte en direct, face à l’interlocuteur qui l’accepte, pour lever un doute sur un mot.

    Recherche

    Rééducation de l’articulation

    Visualiser comment le modèle lit chaque mot aide à travailler l’articulation, avec un orthophoniste, après un AVC ou pour une prothèse vocale.

    Studio

    Racontez une histoire.
    Il apprend vos lèvres.

    Placez-vous devant la caméra et parlez de ce que vous voulez : votre journée, un voyage, une recette. Aucun texte à lire.

    Le son sert uniquement à étiqueter : il est transcrit sur la machine, découpé en phrases de six secondes, et chaque phrase est associée aux images de votre bouche. Un adaptateur personnel s’entraîne ensuite, et se mesure sur des phrases qu’il n’a jamais vues.

    1. filmer en parlant
    2. transcrire le son
    3. découper en phrases
    4. extraire les bouches
    5. entraîner et mesurer

    Chaque séance s’ajoute à votre profil. Dix minutes de parole suffisent pour une première mesure fiable.

    modèle général étapes d’apprentissage → % d’erreurs
    Illustration d’une courbe d’apprentissage : le taux d’erreur sur la validation baisse sous le niveau du modèle général, et le meilleur point est gardé. En recherche, un profil personnel a gagné de 6 à 15 points sur la personne concernée.

    Signatures

    Chaque phrase dessine sa forme.

    Tous les contours des lèvres d’une phrase, superposés comme une photo en pose longue, du bleu (début) au vert (fin). C’est ce motif, et non le son, que le modèle apprend à reconnaître. Survolez-les pour les rejouer ; sur téléphone, elles se rejouent seules.

    Usages

    Partout où l’image existe
    et où le son manque.

    Fonctionne aujourd’hui En préparation Recherche

    Fonctionne aujourd’hui

    Commandes mains libres

    Chirurgie, atelier, cuisine, gants, bruit de machines : commander un écran sans toucher ni crier.

    En préparation

    Sous-titres depuis l’image

    Proposer un sous-titre quand le son est inaudible, coupé ou saturé, et le corriger en quelques clics.

    En préparation

    Réparer un audio manquant

    Un micro qui décroche, un passage couvert par le vent : les lèvres restent visibles. Lipsapp propose les mots manquants, qu’une voix de synthèse peut réinsérer.

    Recherche

    Qui dit quoi, en bulles

    Des bulles de bande dessinée posées près de chaque visage dans une vidéo muette. Attribuer la parole sans le son reste un problème de recherche ouvert.

    Recherche

    Aide au doublage

    Retrouver le texte articulé à l’écran pour caler une traduction sur le mouvement des lèvres.

    Recherche

    Archives muettes

    Films de famille, images d’archives sans bande-son : proposer ce que disaient les gens, avec l’accord des familles ou des institutions.

    Recherche

    Analyse vidéo encadrée

    Pour des enquêtes judiciaires, des expertises ou des journalistes, sur réquisition ou avec le consentement des personnes filmées. Jamais pour écouter quelqu’un à son insu.

    Recherche

    Apprendre une langue

    Voir si votre articulation se lit comme le mot visé : un retour visuel pour travailler la prononciation.

    Fonctionne aujourd’hui

    Dictée discrète

    Écrire un message dans une salle d’attente ou une bibliothèque, sans que personne n’entende.

    Confiance

    Lire sur les lèvres engage.
    Nos règles sont écrites.

    Sur l’appareil

    La lecture, l’entraînement et vos vidéos restent sur votre iPhone ou votre Mac. Aucune image n’est envoyée à un serveur.

    Consentement d’abord

    Un profil personnel ne s’entraîne que sur la personne qui l’a voulu. Lipsapp n’est pas conçu pour lire les lèvres de quelqu’un à son insu, et ne sera pas vendu pour cela.

    Vous gardez la main

    Chaque action sensible attend votre confirmation. Chaque texte proposé reste modifiable. Les corrections d’une IA sont toujours affichées à côté du texte lu.

    Des chiffres mesurés

    Nous publions des taux d’erreur mesurés sur des phrases jamais vues à l’entraînement, avec la taille du test. Pas de promesse sans protocole.

    Disponibilité

    D’abord sur iPhone et Mac.

    Lipsapp arrive sur iOS et macOS, en français et en anglais. Les puces Apple font tourner le modèle localement, en temps réel. D’autres plateformes suivront.

    • iOS 17+ · iPhone
    • macOS 14+ · Apple Silicon
    • français · anglais

    Construisons-le avec vous.

    Association, hôpital, orthophoniste, studio, chercheur, ou simplement concerné : parlez-nous de votre usage. Les premiers testeurs façonnent l’app.

    Ou retrouvez-nous sur ohadja.com