VoxFrame FAQ

Informations produit

Questions fréquentes

Des réponses claires sur VoxFrame, les tarifs, les fonctions prises en charge et la livraison sécurisée.

Commencer ici

Démarrage et sortie

À quoi sert VoxFrame?

VoxFrame est un lecteur vidéo Windows conçu autour des sous-titres. Il lit les vidéos locales et les flux IPTV/en direct légaux, cherche d'abord des sous-titres humains existants et peut traduire, synchroniser ou transcrire lorsqu'aucun sous-titre exploitable n'est disponible.

VoxFrame comprend aussi des contrôles de qualité, des outils de réparation et de révision, l'export, LAN Watch et une prise en charge Cast distincte.

Puis-je déjà télécharger VoxFrame publiquement?

Pas encore. Les téléchargements publics seront ouverts après la signature de l'installateur et la réussite des derniers contrôles de sortie.

D'ici là, les builds de test passent par le compte protégé et les mises à jour intégrées; ils ne doivent pas être partagés.

Quels fichiers sont pris en charge?

Vidéo locale: MP4, MKV, AVI, MOV, WebM, M4V et TS. Sous-titres: SRT, VTT, WebVTT, ASS et SSA.

Pour l'IPTV, VoxFrame peut ouvrir des playlists légales M3U/M3U8 et des URL de flux direct compatibles. VoxFrame ne contourne ni les DRM ni les restrictions d'accès.

Sous-titres humains d'abord

Routes de sous-titres

Comment Subtitle Assistant choisit-il un sous-titre?

VoxFrame vérifie d'abord les pistes intégrées et les fichiers sidecar locaux. Il cherche ensuite dans OpenSubtitles pour la langue choisie. Si cette langue manque, il peut traduire un sous-titre humain anglais adapté. La génération speech-to-text reste le dernier recours.

La source, la langue et le niveau de correspondance sélectionnés restent visibles pour permettre de vérifier le choix.

Le transcript live fonctionne-t-il avec les vidéos locales?

Non. Live transcript / translate est prévu pour les flux IPTV/en direct. Une vidéo locale utilise les workflows normaux: recherche, génération de sous-titres AI, synchronisation avec Fast STT, traduction, réparation et export.

Captions synchronisées

IPTV en direct

Quelle configuration de sous-titres live choisir?
  • Meilleure qualité locale - recommandée: la configuration locale testée la plus complète. L'audio reste sur ce PC, un PC/GPU adapté est recommandé et la lecture synchronisée démarre au moins 35 secondes derrière le direct.
  • Local plus léger - PC/GPU limité: utilise le modèle vocal local sélectionné avec une configuration live allégée et au moins 30 secondes de tampon de synchronisation.
  • API OpenAI personnelle - direct: envoie l'audio live directement à OpenAI avec votre clé enregistrée et utilise au moins 30 secondes de tampon de synchronisation. Cette option apparaît lorsque VoxFrame Cloud est désactivé et qu'une clé est stockée.
  • Qualité cloud synchronisée - recommandée: le premier des deux seuls profils Cloud; traite des blocs de parole de 10 secondes via VoxFrame Cloud.
  • Cloud avec contexte de dialogue plus long: le deuxième profil Cloud; utilise des blocs de 12 secondes pour davantage de contexte, mais n'identifie pas les intervenants.

Les profils Cloud apparaissent uniquement lorsque le compte est autorisé à utiliser VoxFrame Cloud. Les profils locaux nécessitent un moteur STT local et un modèle installés.

Pourquoi la lecture live est-elle décalée?

Le décalage est volontaire: vidéo, audio et captions utilisent la même timeline mise en mémoire tampon. Meilleure qualité locale démarre au moins 35 secondes derrière le direct; Local plus léger et API OpenAI personnelle - direct démarrent au moins 30 secondes derrière. Cloud démarre au moins 60 secondes derrière le direct. Le temps de transcription et de traduction éventuelle s'ajoute à ces tampons.

Le réglage 0 / +1 / +2 / +3 / +5 secondes décale seulement les captions davantage; il ne réduit pas le tampon de synchronisation.

Un flux live crée-t-il un fichier SRT?

Non. Les captions live restent en mémoire pendant la session active et s'affichent en superposition. VoxFrame ne crée ni ne conserve de SRT live. Les fichiers audio et de tampon temporaires sont supprimés après l'arrêt.

Une session LAN Watch active peut transporter temporairement les captions en WebVTT, mais il ne s'agit pas d'un fichier de sous-titres live normalement téléchargeable.

Que signifie la note de musique?

Le symbole signifie que la reconnaissance vocale a renvoyé un libellé explicite de musique. VoxFrame transforme des libellés courts comme « music » ou « [background music] » en ce symbole. Il n'identifie ni le morceau ni l'artiste.

Cloud avec contexte plus long identifie-t-il les intervenants?

Non. Le profil Cloud avec contexte de dialogue plus long fournit un bloc audio légèrement plus long à la transcription, mais n'effectue pas de diarisation et ne nomme ni ne marque les intervenants.

Puis-je changer la langue cible pendant le direct?

Oui. Les nouveaux blocs utilisent la nouvelle langue cible sans redémarrer le flux. Les captions déjà affichées ne sont pas retraduites.

Choisir sa route

Confidentialité et facturation

Ai-je besoin de Premium Cloud?

Non. VoxFrame reste utilisable avec les fonctions locales et vos propres identifiants provider. Premium Cloud est facultatif. Un achat Cloud direct admissible déverrouille aussi Player Pro automatiquement; aucun achat Player séparé préalable n'est nécessaire.

Quelle est la différence entre local, API personnelle et Cloud?
  • Local: le speech-to-text s'exécute sur ce PC; la vitesse dépend du modèle installé et du matériel.
  • API personnelle: les requêtes compatibles vont directement au provider avec votre clé; ce provider facture votre compte.
  • VoxFrame Cloud: les requêtes compatibles utilisent la route serveur mesurée de VoxFrame sans exposer une clé provider VoxFrame dans l'application.
Où vont mes données audio?

Avec un profil live local, le traitement audio reste sur le PC. Avec API OpenAI personnelle - direct, les blocs audio vont directement à OpenAI et utilisent votre facturation OpenAI; aucun crédit VoxFrame Cloud n'est consommé. Avec un profil Cloud, les blocs audio sont envoyés par HTTPS à VoxFrame pour traitement par OpenAI.

La consommation de transcription Cloud est comptée après une transcription réussie. La traduction live est une action de traitement distincte.

Sur chaque écran

LAN Watch et Cast

Quelle est la différence entre LAN Watch et Chromecast?

LAN Watch démarre un lecteur web HLS temporaire et affiche un lien ainsi qu'un code QR pour un navigateur sur le même réseau local. C'est la route principale pour navigateur, téléphone, tablette et navigateur TV.

Chromecast, Google TV et DLNA sont des routes d'appareil séparées. La disponibilité et la compatibilité des sous-titres dépendent de l'appareil réel, du réseau et du codec; la prise en charge de tous les téléviseurs ou formats n'est pas garantie.

En cas de problème

Dépannage et assistance

Pourquoi une ligne manque-t-elle parfois ou les captions s'arrêtent-elles?

La reconnaissance vocale n'est pas parfaite. Le silence, la musique, une parole peu claire, un PC surchargé, un provider lent ou un flux instable peuvent produire un bloc vide ou tardif. Un bloc ayant déjà manqué sa fenêtre de lecture peut être ignoré pour éviter un retard permanent.

Les entrées locales et avec clé personnelle sont lues en temps réel afin d'éviter un afflux au démarrage. Une erreur locale isolée peut laisser un court vide tandis que la session continue; trois erreurs provider locales consécutives arrêtent le workflow live. L'affichage direct avec clé personnelle garde les cues rapides et courts visibles au moins environ 1,4 seconde et peut conserver jusqu'à trois cues très rapprochés; une vraie pause de plus d'environ 0,8 seconde interrompt cet historique glissant. Les courtes fausses mentions de crédits connues sont filtrées, mais VoxFrame ne peut pas reconstruire une parole que le provider n'a pas transcrite.

Que signifient Listening, No speech yet et Failed?
  • Listening: la session live fonctionne et attend une parole exploitable.
  • No speech yet: des blocs ont été vérifiés sans parole claire; ce n'est pas automatiquement une erreur.
  • Degraded: une partie du workflow est temporairement limitée; les captions source peuvent continuer si la traduction prend du retard.
  • Reconnecting: VoxFrame effectue une nouvelle tentative limitée.
  • Failed: un problème technique a arrêté le workflow live.
Que dois-je envoyer au support?

Envoyez la version de l'application, l'action lancée, le profil local/clé personnelle/Cloud choisi, la langue parlée et la langue cible, le statut exact affiché et un supportlog nettoyé via Settings > About > Export safe support log.

N'envoyez jamais de clés de licence, clés provider, tokens d'accès, données de paiement ou fichiers personnels sans rapport.