Álbum de fotos

Vista frontal da máquina multifuncional Sansheng Digital Human.
01-Frente
Imagem mostrando a interface traseira da máquina multifuncional Sansheng Digital Human.
01-Voltar

I. Sobre o Produto

1.1 Introdução ao Produto

Este produto é um sistema de humano digital interativo por voz, adequado para implantação privada em empresas. É aplicável à interação inteligente por voz e à consulta/resposta de dados em empresas, escolas e órgãos governamentais. Desenvolvido com base em um modelo de inferência em larga escala, um modelo de reconhecimento de fala, um modelo de síntese de fala e um mecanismo de fluxo de trabalho, ele pode alternar de forma flexível entre modelos de implantação em rede pública e local para atender às necessidades de processamento de dados personalizados das empresas. É focado em valor comercial, leve, personalizável e pode ser implantado rapidamente.

1.2 Representação de Personagens

Permite personalizar a imagem do seu personagem e oferece mais de dez imagens para escolher na biblioteca de imagens.

1.3 Principais Vantagens

A principal diferença entre nós e outros fabricantes de humanos digitais:

  • Utilização em múltiplos terminais: Não se limitando a máquinas tudo-em-um, pode ser utilizado de forma flexível em diversos terminais, como computadores Windows, tablets Android (sinais de sala de aula), páginas web, contas oficiais e miniprogramas.
  • Respostas a perguntas privadas: Permite a conexão flexível com dados internos da empresa por meio de interfaces, consultas a bancos de dados, etc., possibilitando que humanos digitais respondam a conteúdo exclusivo e possibilitando a consulta flexível de relatórios, vídeos e outros conteúdos.
  • Implantação localizada: Suporta implantação privada localizada em empresas, executada na intranet (todos os modelos e dados de grande porte são locais).

1.4 Lista de funções do software

Número de sériecategoriaSubitemilustrar
1Personalização de personagem1.1 Clonagem de CaracteresGravação em tela verde: Clonagem humana digital baseada em vídeos gravados em tela verde fornecidos pela pessoa alvo; Síntese por IA: Geração da imagem de uma pessoa com base em sua foto; Suporta diversas ações como esperar, ficar parado com as mãos abaixadas, falar com as mãos juntas, falar com uma mão e falar com as duas mãos.
1.2 Clonagem de Voz de PersonagemSuporta replicação rápida de 3 segundos, fornecendo de 3 a 10 segundos de gravações de voz humana reais para replicar rapidamente as características vocais da pessoa.
1.3 Configurações de fundoOferece opções para definir e alterar a imagem de fundo do humano digital.
2Tecnologia de voz2.1 Ativação por vozO sistema permite nomear humanos digitais, e o humano digital irá despertar ativamente e iniciar uma conversa quando ouvir alguém chamando seu nome.
2.2 Reconhecimento de FalaBaseado em um modelo de fala abrangente, este framework de reconhecimento de fala em tempo real e de ponta a ponta apresenta uma taxa de erro de palavras e velocidade de inferência simultânea líderes do setor. Ele suporta o reconhecimento de dialetos e pode identificar mais de 10 idiomas nacionais.
2.3 Síntese de FalaSíntese de fala baseada em um modelo de fala abrangente, oferecendo múltiplas opções de voz. Algoritmos de áudio: AEC, ANC, AGC.

1.5 Máquina Digital Humana Tudo-em-Um

Um dispositivo terminal interativo inteligente que integra uma câmera e um microfone, pronto para uso imediato.

II. Cenários de Aplicação

PC All-in-One com tela sensível ao toque de 2,1 polegadas

Este equipamento multifuncional vertical com tela sensível ao toque é ideal para ambientes como saguões e salas de exposições, permitindo que os usuários interajam diretamente por toque ou voz.

2.2 Porta-retratos eletrônico

A tela interativa com o humano digital, em formato de moldura de obra de arte, pode ser integrada a ambientes domésticos e de escritório, permitindo que os usuários conversem com o humano digital dentro da moldura eletrônica por meio de perguntas e respostas ativadas por voz.

2.3 Guia do Salão de Exposições

Uma solução digital de explicação baseada em interação humana, adequada para cenários como museus de história escolares, showrooms corporativos e museus, com suporte para exibição integrada em telas grandes.

2.4 Consulta de Dados Industriais

Este humano digital, projetado para cenários industriais, permite que os usuários consultem dados de produção, status de equipamentos e outras informações por meio de interação por voz.

2.5 PC com Windows

projetoEspecificação
Método de instalaçãoFornece instalador .exe
Terminais aplicáveisComputador multifuncional para pódio/tela sensível ao toque
CPUProcessadores i3 e superiores
Cenários típicosComputador em pódio de sala de aula, questionário interdisciplinar de conhecimento humano digital

2.6 Sinalização Eletrônica de Sala de Aula

projetoEspecificação
Tela de exibiçãoTela IPS LCD
tamanho18,5 polegadas
resolução1920 × 1080
chipRK3288 Quad-core 1.8GHz
Memória2 GB
memória flash16 GB

2.7 Cão Robô Industrial

Um cão robô biônico quadrúpede, uma plataforma móvel de interação humana digital, capaz de se deslocar por terrenos complexos e interagir com os usuários por meio de voz.

2.8 Conferências de grande escala

A solução de tela interativa extragrande é adequada para exibição e interação humana digital em cenários como grandes conferências e salas de aula.

III. Clonagem de Personagens

3.1 Filmagem com Tela Verde

A clonagem humana digital é realizada com base em vídeos em tela verde fornecidos pela pessoa alvo. A gravação deve ser feita em um ambiente profissional com tela verde. Após o envio das imagens de vídeo em alta definição, o treinamento de imagem geralmente pode ser concluído em 1 a 2 dias úteis.

3.2 Combinação de Fotos

Avatares gerados por IA com base em fotografias podem criar rapidamente aparências humanas digitais sem a necessidade de equipamentos especializados.

3.3 Síntese Sonora

Permite a replicação rápida de características da voz em 3 segundos. Apenas 3 a 10 segundos de gravação de fala de uma pessoa real são necessários para replicar as características da voz para uso na síntese digital da fala humana.

IV. Humano Digital de Front-end

4.1 Perguntas e Respostas sobre Humanos Digitais

4.1.1 Resposta de texto

O humano digital responde às perguntas do usuário em formato de texto simples, o que é adequado para cenários gerais de perguntas e respostas baseadas em conhecimento.

4.1.2 Responda com imagens e texto

Quando uma pergunta exige explicitamente uma resposta com "texto e imagens", o humano digital pode exibir tanto texto quanto imagens na resposta.

4.1.3 Respostas em vídeo

Quando a pergunta exige explicitamente uma "resposta em vídeo", o humano digital pode acessar e reproduzir os materiais de vídeo já configurados no sistema (os recursos do sistema devem conter os materiais de vídeo correspondentes).

4.2 Comutação de Interface

4.2.1 Comutação multimodo

Você pode alternar livremente entre os modos de entrada de voz e entrada de texto.

4.2.2 Troca de Múltiplos Processos em Segundo Plano

Permite alterar a imagem de fundo do humano digital.

4.2.3 Comutação multirresolução

Oferece múltiplas resoluções, incluindo 1K, 2K e 4K, adequadas tanto para dispositivos comuns quanto para computadores tudo-em-um com telas grandes.

4.2.4 Alternando entre várias figuras humanas digitais

Windows: Selecione o humano digital que deseja executar no aplicativo de humanos digitais; Android: Clique no ponto no canto superior esquerdo da interface para abrir a interface de troca de humanos digitais.

4.2.5 Alternando entre os modos paisagem e retrato

O modo paisagem é adequado para palestras com recursos visuais e apresentações corporativas; o modo retrato é adequado para computadores tudo-em-um com telas grandes. Clique no menu à direita para alternar.

4.3 Alternando entre modos de diálogo

4.3.1 Modo de ativação

O sistema inicia por padrão no modo de ativação, que liga automaticamente o humano digital e inicia uma conversa quando ele ouve alguém chamar seu "nome".

4.3.2 Modo de entrada de texto

Clique no menu "Modo de Entrada" e uma caixa de entrada de texto será exibida. Digite o conteúdo relevante para conversar com o humano digital.

4.3.3 Modo de Diálogo do Celular

Clique no menu "Entrada de voz" e, em seguida, pressione e mantenha pressionado o botão abaixo para conversar com o humano digital por meio de voz.

4.4 Gerenciamento de Aplicativos

Atualização do aplicativo 4.4.1

Permite atualizações online do cliente humano digital através do aplicativo.

4.4.2 Autorização do aplicativo

Ele oferece suporte ao gerenciamento de autorização de aplicativos, permitindo o controle das permissões de uso de diferentes usuários.

V. Sistema de gerenciamento de back-end

5.1 Operação do Sistema

Download do cliente 5.1.1

Faça o download dos pacotes de instalação do cliente para cada plataforma no painel de administração.

5.1.2 Gestão de Recursos Humanos Multidígito

Fornecemos de um a dezenas de avatares digitais para diferentes clientes, os quais são gerenciados de forma uniforme através da interface de informações do avatar.

5.1.3 Renomeação de Humanos Digitais

O nome do humano digital é a palavra de ativação; quando o humano digital ouve esse nome, ele começa a conversar.

Nota especial: Esta tecnologia utiliza um SDK de ativação por voz offline, com baixa taxa de falsos positivos e precisão de reconhecimento líder do setor. No entanto, recomenda-se que o nome do humano digital tenha pelo menos quatro caracteres (por exemplo, "Professor Xiao Wang"). Se forem usados ​​apenas dois caracteres (por exemplo, "Xiao Wang"), o humano digital ainda poderá ser ativado erroneamente ao ouvir "Xiao Wang". Após a renomeação, o servidor do projeto deve ser reiniciado (entre em contato com o administrador para reiniciar).

5.1.4 Consulta de registro de diálogo

Você pode filtrar por diferentes usuários digitais para visualizar os registros de conversas recentes.

5.1.5 Autorização do Sistema de Usuário

Diferentes permissões de menu e permissões de dados são concedidas a diferentes tipos de usuários.

5.2 Gestão da Base de Conhecimento de Documentos

📌 Usuários comuns podem simplesmente fazer o upload de arquivos; não são necessários ajustes na estratégia de segmentação.

5.2.1 Gerenciamento de Arquivos

Selecione o upload de arquivo local (com suporte para arrastar e soltar), o sistema dividirá o arquivo de acordo com a estratégia padrão: chunk_size=500, chunk_overlap=50, separator=['\n\n'].

5.2.2 Gestão Segmentada

Permite visualizar e ajustar manualmente segmentos de documentos carregados.

5.3 Gestão da Base de Conhecimento de Garantia da Qualidade

5.3.1 Gestão de pares em sessões de perguntas e respostas

Manter manualmente pares de perguntas e respostas padrão, adequados para cenários de alta frequência e que exigem respostas precisas.

5.3.2 Respostas precisas a perguntas e respostas

Permite configurar regras de correspondência precisas para garantir que uma resposta padrão predefinida seja retornada para uma pergunta específica.

5.4 Modelo Grande Relacionado

5.4.1 Seleção do Modelo

Ele oferece suporte à alternância flexível entre o modelo de rede pública de grande porte e o modelo de implantação local.

5.4.2 Treinamento do Modelo

Ele oferece suporte ao ajuste fino e ao treinamento de modelos com base em dados privados da empresa.

5.5 Fluxo de Trabalho Humano Digital

5.5.1 Gerenciamento de Fluxo de Trabalho

Orquestre visualmente o processo de perguntas e respostas do humano digital, com suporte para configuração de nós por meio de arrastar e soltar.

Nome do nóDescrição da função
5.5.2 Nó InicialNó inicial do fluxo de trabalho (criado automaticamente, não pode ser copiado ou excluído). Configuração: A mensagem inicial está vazia; recupera automaticamente a hora atual (aaaa-mm-dd hh:mm); armazena os n registros de bate-papo mais recentes, sendo possível personalizar o número de registros.
5.5.3 Nó de entradaEle recebe o conteúdo inserido pelo usuário na caixa de diálogo e o armazena na variável user_input, não exigindo nenhuma configuração adicional.
5.5.4 Nó de SaídaDefina o conteúdo da resposta final retornada ao usuário.
5.5.5 Nós de Modelo GrandesChame o LLM para realizar inferências e gerar respostas.
5.5.6 Nó AssistenteConfigure comandos de prompt em nível de sistema e comportamentos do assistente.
5.5.7 Nó de Recuperação da Base de Conhecimento de Garantia de QualidadeRecupere pares de perguntas e respostas correspondentes da base de conhecimento de perguntas e respostas.
5.5.8 Nó de Perguntas e Respostas da Base de Conhecimento de DocumentosRecupere o conteúdo relevante da base de conhecimento do documento para responder à pergunta.
5.5.9 Nó de ramificação condicionalDetermine o fluxo do processo com base em condições para implementar uma lógica de diálogo complexa.

5.6 Ferramentas do Sistema

Fornece ferramentas e funções auxiliares relacionadas à operação e manutenção do sistema.

VI. Lado SaaS: Criando um novo humano digital

etapaoperarilustrar
primeiro passo6.1 Usuários RegistradosCrie uma conta na plataforma SaaS.
Etapa 26.2.1 Criando um novo fluxo de trabalhoCriar um fluxo de diálogo para humanos digitais.
6.2.2 Criação de uma nova base de conhecimentoFaça upload de documentos ou configure pares de perguntas e respostas para o controle de qualidade.
Etapa 36.3.1 Criando uma nova imagem de personagemEscolha ou personalize a aparência do seu humano digital.
6.3.2 Configuração de AssociaçãoAssegure-se de que o fluxo de trabalho e a base de conhecimento dessa pessoa estejam devidamente interligados.
Passo 46.4.1 Obtenção do Número de SérieClique no pequeno círculo no canto superior esquerdo do dispositivo para verificar o número de série do dispositivo.
6.4.2 Vinculação de DispositivosInsira o número de série na seção "Vincular Dispositivo" do sistema de gerenciamento. Após reiniciar o aplicativo, o dispositivo exibirá o humano digital recém-criado, cujas respostas são baseadas em uma base de conhecimento dedicada.

VII. Implantação da Privatização

7.1 Configuração do Servidor do Sistema

matériailustrar
7.1.1 Máquina Humana Digital Tudo-em-UmDispositivos de hardware que integram tela sensível ao toque, câmera e microfone, prontos para uso imediato.
7.1.2 Servidor de Computação de Modelos Grandes (Opcional)Para executar modelos grandes localmente, recomenda-se um servidor com GPU (NVIDIA RTX 3060 ou superior) com 16 GB ou mais de RAM e 50 GB ou mais de espaço disponível em disco rígido, dependendo da concorrência e do tamanho do modelo.

7.2 Compilação de Dados do Projeto

Tipo de dadosilustrar
7.2.1 Aparência e voz do personagemForneça um vídeo com fundo verde ou uma foto em alta definição da pessoa em questão, juntamente com uma amostra de áudio de 3 a 10 segundos.
7.2.2 Compilação de Perguntas e RespostasCompile perguntas frequentes da empresa e suas respostas padrão e importe-as para a base de conhecimento de controle de qualidade.
7.2.3 Processamento de Dados (RAG)Organize documentos corporativos (compatível com PDF, Word, TXT, Markdown e outros formatos), e o sistema os analisa automaticamente e gera resultados de pesquisa RAG aprimorados.

7.3 Integração de Dados

  • 7.3.1 Integração com a Base de Conhecimento de QA: Importe os pares de perguntas e respostas de QA compilados para o sistema.
  • 7.3.2 Integração com a base de conhecimento de documentos: Faça o upload de documentos corporativos e o sistema os segmentará e indexará automaticamente.
  • 7.3.3 Integração de consultas ao banco de dados: Ao integrar-se com o banco de dados interno da empresa, o humano digital pode consultar dados comerciais (como relatórios, ordens de serviço, etc.) em tempo real.

VIII. Precauções

8.1 Ligar/desligar temporizado

Configure temporizadores para ligar/desligar através de dispositivos móveis, como desligar às 22h e ligar às 8h, para garantir um funcionamento estável e economizar energia.

微信二维码 WeChat
WhatsApp二维码 WhatAPP
Consulta online