album photo
I. À propos du produit
1.1 Présentation du produit
Ce produit est un système humain numérique à interaction vocale conçu pour un déploiement privé en entreprise. Il permet une interaction vocale intelligente et l'interrogation/la réponse aux questions dans les entreprises, les établissements scolaires et les administrations. Développé à partir d'un modèle d'inférence à grande échelle, d'un modèle de reconnaissance vocale, d'un modèle de synthèse vocale et d'un moteur de flux de travail, il peut basculer facilement entre un déploiement sur réseau public et un déploiement local afin de répondre aux besoins de traitement de données personnalisés des entreprises. Axé sur la valeur ajoutée pour l'entreprise, il est léger, personnalisable et se déploie rapidement.
1.2 Représentation du personnage
Il permet de personnaliser l'image de votre personnage et propose plus de dix images parmi lesquelles choisir dans la bibliothèque d'images.
1.3 Principaux avantages
La principale différence entre nous et les autres fabricants d'humains numériques :
- Utilisation multi-terminal : Ne se limitant pas aux machines tout-en-un, il peut être utilisé de manière flexible sur plusieurs terminaux tels que les ordinateurs Windows, les tablettes Android (signatures de classe), les pages Web, les comptes officiels et les mini-programmes.
- Réponse aux questions privées : ce système peut se connecter de manière flexible aux données internes de l’entreprise via des interfaces, des requêtes de base de données, etc., permettant ainsi à des humains numériques de répondre à un contenu exclusif et d’interroger de manière flexible des rapports, des vidéos et d’autres contenus.
- Déploiement localisé : Prend en charge le déploiement privé localisé au sein des entreprises, exécuté sur l'intranet (tous les modèles et données volumineux sont locaux).
1.4 Liste des fonctions du logiciel
| Numéro de série | catégorie | Sous-élément | illustrer |
|---|---|---|---|
| 1 | Personnalisation des personnages | 1.1 Clonage de personnages | Prise de vue sur fond vert : Clonage numérique humain basé sur des vidéos prises sur fond vert fournies par la personne cible ; Synthèse par IA : Génération d’une image de personne à partir d’une photo ; Prend en charge diverses actions telles que l’attente, la position debout immobile les mains baissées, parler les mains jointes, parler d’une seule main et parler des deux mains. |
| 1.2 Clonage de voix de personnages | Il prend en charge la réplication rapide en 3 secondes, fournissant 3 à 10 secondes d'enregistrements de voix humaine réelle pour reproduire rapidement les caractéristiques vocales de la personne. | ||
| 1.3 Paramètres d'arrière-plan | Offre des options pour définir et modifier l'image d'arrière-plan de l'humain numérique. | ||
| 2 | Technologie vocale | 2.1 Réveil vocal | Il permet de nommer les humains numériques, et ces derniers se réveillent et engagent la conversation lorsqu'ils entendent quelqu'un les appeler par leur nom. |
| 2.2 Reconnaissance vocale | S’appuyant sur un modèle vocal de grande envergure, ce système de reconnaissance vocale temps réel et de bout en bout offre un taux d’erreur de mots et une vitesse d’inférence simultanée parmi les plus bas du marché. Il prend en charge la reconnaissance des dialectes et peut identifier plus de 10 langues nationales. | ||
| 2.3 Synthèse vocale | Synthèse vocale basée sur un modèle vocal étendu, offrant de multiples options de voix. Algorithmes audio : AEC, ANC, AGC. |
Machine tout-en-un humaine numérique 1.5
Un terminal interactif intelligent intégrant une caméra et un microphone, prêt à l'emploi dès sa sortie de l'emballage.



II. Scénarios d'application
PC tout-en-un à écran tactile 2,1 pouces
Cette machine tout-en-un à écran tactile vertical est adaptée à des environnements tels que les halls d'entrée et les salles d'exposition, permettant aux utilisateurs d'interagir directement par le toucher ou la voix.
2.2 Cadre photo électronique
L'écran interactif représentant un humain numérique, en forme de cadre d'art, peut être intégré dans les environnements domestiques et professionnels, permettant aux utilisateurs de converser avec l'humain numérique à l'intérieur du cadre électronique grâce à un système de questions-réponses à commande vocale.
2.3 Guide du hall d'exposition
Une solution d'explication numérique basée sur l'humain, adaptée à des scénarios tels que les musées d'histoire scolaire, les salles d'exposition d'entreprises et les musées, prenant en charge l'affichage intégré sur grand écran.
2.4 Requête de données industrielles
Cet assistant numérique, conçu pour les environnements industriels, permet aux utilisateurs d'interroger les données de production, l'état des équipements et d'autres informations par interaction vocale.
PC Windows 2.5
| projet | Spécification |
|---|---|
| Méthode d'installation | Fournit un programme d'installation exe |
| Terminaux applicables | Ordinateur de podium/Machine tout-en-un à écran tactile |
| Processeur | Processeurs i3 et supérieurs |
| Scénarios typiques | Ordinateur de pupitre en classe, quiz interdisciplinaire sur les connaissances numériques humaines |
2.6 Panneau électronique de classe
| projet | Spécification |
|---|---|
| Écran d'affichage | Écran LCD IPS |
| taille | 18,5 pouces |
| résolution | 1920 × 1080 |
| ébrécher | Processeur quadricœur RK3288 1,8 GHz |
| Mémoire | 2 Go |
| mémoire flash | 16 GB |
2.7 Chien robot industriel
Un chien robot bionique quadrupède, une plateforme mobile d'interaction humaine numérique, capable de se déplacer sur des terrains complexes et d'interagir avec les utilisateurs par la voix.
2.8 Conférences à grande échelle
Cette solution d'écran interactif extra-large est adaptée à l'affichage et à l'interaction numérique avec les personnes dans des scénarios tels que les grandes conférences et les amphithéâtres.




III. Clonage de personnages
3.1 Prise de vue sur fond vert
Le clonage numérique humain est réalisé à partir de vidéos sur fond vert fournies par la personne cible. L'enregistrement doit être effectué dans un environnement professionnel avec fond vert. Après la soumission de la vidéo haute définition, le traitement de l'image peut généralement être réalisé sous 1 à 2 jours ouvrables.
3.2 Combinaison de photos
Les avatars générés par l'IA à partir de photographies peuvent rapidement créer des apparences humaines numériques sans nécessiter d'équipement spécialisé.
3.3 Synthèse sonore
Permet une reproduction rapide des caractéristiques vocales en 3 secondes. Seuls 3 à 10 secondes d'enregistrement vocal d'une personne réelle sont nécessaires pour reproduire ses caractéristiques vocales en vue de la synthèse vocale numérique.



IV. Humain numérique frontal
4.1 Questions et réponses sur l'humain numérique
4.1.1 Réponse par texte
L'humain numérique répond aux questions des utilisateurs en format texte brut, ce qui convient aux scénarios de questions-réponses basés sur des connaissances générales.
4.1.2 Répondre avec des images et du texte
Lorsqu'une question exige explicitement une réponse « texte et images », l'humain numérique peut afficher à la fois du texte et des images dans la réponse.
4.1.3 Réponses vidéo
Lorsque la question exige explicitement une « réponse vidéo », l'humain numérique peut accéder aux ressources vidéo déjà configurées dans le système (les ressources du système doivent contenir les ressources vidéo correspondantes) et les lire.
4.2 Commutation d'interface
4.2.1 Commutation multimode
Vous pouvez basculer librement entre les modes de saisie vocale et de saisie textuelle.
4.2.2 Commutation en arrière-plan multiple
Permet de changer l'image de fond de l'humain numérique.
4.2.3 Commutation multi-résolution
Il offre plusieurs résolutions, notamment 1K, 2K et 4K, adaptées aussi bien aux appareils classiques qu'aux ordinateurs tout-en-un grand écran.
4.2.4 Alternance entre plusieurs figures humaines numériques
Windows : Sélectionnez l’humain numérique que vous souhaitez exécuter via l’application dédiée ; Android : Cliquez sur le point situé dans le coin supérieur gauche de l’interface pour afficher l’interface de sélection de l’humain numérique.
4.2.5 Basculement entre les modes paysage et portrait
Le mode paysage est adapté aux cours magistraux numériques et aux présentations d'entreprise ; le mode portrait est adapté aux ordinateurs multifonctions grand écran. Cliquez sur le menu à droite pour basculer entre les deux modes.
4.3 Basculement entre les modes de dialogue
4.3.1 Mode de réveil
Le système est par défaut en mode réveil, ce qui active automatiquement le mode veille et entame une conversation lorsque l'humain numérique entend quelqu'un l'appeler par son « nom ».
4.3.2 Mode de saisie de texte
Cliquez sur le menu « Mode de saisie », et une zone de saisie de texte apparaîtra. Saisissez le contenu souhaité pour dialoguer avec l'humain virtuel.
4.3.3 Mode de dialogue du téléphone mobile
Cliquez sur le menu « Saisie vocale », puis maintenez enfoncé le bouton ci-dessous pour converser avec l'humain numérique par la voix.
4.4 Gestion des applications
4.4.1 Mise à jour de l'application
Prend en charge les mises à jour en ligne du client humain numérique via l'application.
4.4.2 Autorisation de l'application
Il prend en charge la gestion des autorisations d'applications, permettant de contrôler les autorisations d'utilisation des différents utilisateurs.








V. Système de gestion du backend
5.1 Fonctionnement du système
5.1.1 Téléchargement du client
Téléchargez les packages d'installation client pour chaque plateforme depuis l'interface de gestion.
5.1.2 Gestion des ressources humaines à plusieurs chiffres
Nous fournissons de un à plusieurs dizaines d'avatars numériques pour différents clients, gérés de manière uniforme via l'interface d'information des avatars.
5.1.3 Renommage des humains numériques
Le nom de l'humain numérique est le mot d'activation ; lorsque l'humain numérique entend ce nom, il commence à converser.
5.1.4 Requête du journal de dialogue
Vous pouvez filtrer par différents utilisateurs numériques pour consulter les historiques de conversations récentes.
5.1.5 Autorisation système de l'utilisateur
Des autorisations d'accès aux menus et aux données différentes sont accordées aux différents types d'utilisateurs.
5.2 Gestion de la base de connaissances documentaires
📌 Les utilisateurs réguliers peuvent simplement télécharger des fichiers ; aucun ajustement de la stratégie de segmentation n'est requis.
5.2.1 Gestion des fichiers
Sélectionnez le téléchargement de fichiers locaux (glisser-déposer pris en charge), le système divisera le fichier selon la stratégie par défaut : chunk_size=500, chunk_overlap=50, separator=['\n\n'].
5.2.2 Gestion segmentée
Il permet de visualiser et d'ajuster manuellement des segments de documents téléchargés.
5.3 Gestion de la base de connaissances QA
5.3.1 Gestion des paires question-réponse
Gérer manuellement les paires question-réponse standard, adaptées aux scénarios de réponse précise et fréquente.
5.3.2 Réponses précises aux questions-réponses
Il permet de configurer des règles de correspondance précises afin de garantir qu'une réponse standard prédéfinie soit renvoyée pour une question spécifique.
5.4 Modèles de grande taille
5.4.1 Sélection du modèle
Il permet une commutation flexible entre le modèle de déploiement sur grand réseau public et le modèle de déploiement local.
5.4.2 Formation du modèle
Il permet d'affiner et d'entraîner des modèles à partir de données privées d'entreprise.
5.5 Flux de travail humain numérique
5.5.1 Gestion des flux de travail
Orchestrez visuellement le processus de questions-réponses de l'humain numérique, en prenant en charge la configuration des nœuds par glisser-déposer.
| Nom du nœud | Description de la fonction |
|---|---|
| 5.5.2 Nœud de démarrage | Nœud de démarrage du flux de travail (créé automatiquement, ne peut être ni copié ni supprimé). Configuration : le message d’ouverture est vide ; récupère automatiquement l’heure actuelle (aaaa-mm-jj hh:mm) ; stocke les n derniers enregistrements de conversation (nombre personnalisable). |
| 5.5.3 Nœud d'entrée | Il reçoit le contenu saisi par l'utilisateur dans la boîte de dialogue et le stocke dans la variable user_input, sans nécessiter de configuration supplémentaire. |
| 5.5.4 Nœud de sortie | Définissez le contenu de la réponse finale renvoyée à l'utilisateur. |
| 5.5.5 Grands nœuds de modèle | Appelez LLM pour effectuer l'inférence et générer les réponses. |
| 5.5.6 Nœud assistant | Configurer les commandes d'invite système et les comportements de l'assistant. |
| 5.5.7 Nœud de récupération de la base de connaissances QA | Récupérer les paires question-réponse correspondantes dans la base de connaissances QA. |
| 5.5.8 Base de connaissances documentaires - Nœud de questions-réponses | Extraire le contenu pertinent de la base de connaissances documentaires pour répondre à la question. |
| 5.5.9 Nœud de branche conditionnel | Déterminer le déroulement du processus en fonction des conditions permettant de mettre en œuvre une logique de dialogue complexe. |
5.6 Outils système
Fournit des outils et des fonctions auxiliaires liés à l'exploitation et à la maintenance du système.











VI. Côté SaaS : Créer un nouvel humain numérique
| étape | fonctionner | illustrer |
|---|---|---|
| premier pas | 6.1 Utilisateurs enregistrés | Créez un compte sur la plateforme SaaS. |
| Étape 2 | 6.2.1 Création d'un nouveau flux de travail | Créer un flux de dialogue pour les humains numériques. |
| 6.2.2 Création d'une nouvelle base de connaissances | Téléchargez des documents ou configurez des paires de questions-réponses pour l'assurance qualité. | |
| Étape 3 | 6.3.1 Création d'une nouvelle image de personnage | Choisissez ou personnalisez l'apparence de votre humain numérique. |
| 6.3.2 Configuration de l'association | Assurez-vous que le flux de travail et la base de connaissances de cette personne soient correctement liés. | |
| Étape 4 | 6.4.1 Obtention du numéro de série | Cliquez sur le petit cercle situé dans le coin supérieur gauche de l'appareil pour vérifier son numéro de série. |
| 6.4.2 Liaison de périphérique | Saisissez le numéro de série dans la section « Associer un appareil » du système de gestion. Après le redémarrage de l’application, l’appareil affichera l’humain numérique nouvellement créé, dont les réponses s’appuient sur une base de connaissances dédiée. |








VII. Déploiement de la privatisation
7.1 Configuration du serveur système
| matière | illustrer |
|---|---|
| 7.1.1 Machine tout-en-un humaine numérique | Appareils matériels intégrant un écran tactile, une caméra et un microphone, prêts à l'emploi dès leur sortie de l'emballage. |
| 7.1.2 Serveur de calcul pour modèles volumineux (optionnel) | Pour exécuter des modèles volumineux en local, un serveur GPU (NVIDIA RTX 3060 ou supérieur) avec 16 Go de RAM ou plus et 50 Go d'espace disque disponible ou plus est recommandé, en fonction de la concurrence et de la taille du modèle. |
7.2 Compilation des données du projet
| Type de données | illustrer |
|---|---|
| 7.2.1 Apparence et voix des personnages | Fournissez une vidéo sur fond vert ou une photo haute définition de la personne ciblée, accompagnée d'un extrait audio de 3 à 10 secondes. |
| 7.2.2 Compilation de questions et réponses QA | Compilez les questions courantes en entreprise et les réponses standard, puis importez-les dans la base de connaissances QA. |
| 7.2.3 Traitement des données (RAG) | Organisez les documents d'entreprise (prise en charge des formats PDF, Word, TXT, Markdown et autres), et le système analyse et génère automatiquement des résultats de recherche RAG améliorés. |
7.3 Intégration des données
- 7.3.1 Intégration avec la base de connaissances QA : Importer les paires de questions et réponses QA compilées dans le système.
- 7.3.2 Intégration avec la base de connaissances documentaires : Téléchargez les documents d'entreprise, et le système les segmentera et les indexera automatiquement.
- 7.3.3 Intégration des requêtes de base de données : En s'intégrant à la base de données interne de l'entreprise, l'humain numérique peut interroger les données commerciales (telles que les rapports, les ordres de travail, etc.) en temps réel.

VIII. Précautions
8.1 Mise sous/hors tension programmée
Programmez des minuteries pour la mise en marche/arrêt via une tablette, par exemple l'extinction à 22h et la mise en marche à 8h, afin de garantir un fonctionnement stable et d'économiser de l'énergie.

WeChat
WhatAPP