AI Voice Recognition Module — Keyword Wake-Up, Bilingual Speech, 110+ Commands

¥117.00
Em estoque
Módulo
-
+
Global Shipping from Shenzhen to worldwide
Open Source transparent hardware & software
Technical Support community & expert guidance
Pergunte sobre este produto

Faça uma pergunta

Visão Geral do Módulo de Interação de Voz com IA

Módulo de Interação de Voz com IA— Ativação por Palavra-Chave | Reconhecimento Chinês e Inglês | Vocabulário/Parâmetros Personalizáveis

  • Mais de 110 comandos predefinidos de interação por voz

  • Design integrado de reconhecimento e reprodução

  • Suporte a vocabulário de voz personalizado

  • Reconhecimento de longo alcance de 6 metros

  • 99% de precisão de reconhecimento

  • Captação omnidirecional de 360 graus

  • Cancelamento de eco e fidelidade de redução de ruído

  • Reconhecimento offline

  • Redução de ruído ambiental

Recursos Principais — Interação de Voz com IA

  • Ativação por palavra-chave KWS

  • Reprodução por transmissão de voz

  • Reconhecimento bilíngue chinês e inglês

  • Microfone omnidirecional de 360 graus

  • Alto-falante de alta fidelidade

  • Vocabulário e parâmetros personalizáveis

  • Cancelamento de eco e redução de ruído inteligentes

  • Reconhecimento de longo alcance de 6m

  • Alta precisão de reconhecimento

  • Tutoriais abrangentes de desenvolvimento incluídos

Introdução ao Módulo de Interação de Voz com IA

O Módulo de Interação de Voz integra reconhecimento de voz e reprodução de voz em uma única unidade. Possui microfone e alto-falante integrados, além de um poderoso processador de rede neural que suporta operações de redes neurais convolucionais e redução de ruído por aprendizado profundo, entregando cancelamento de eco robusto e supressão de ruído ambiental. Novas palavras de comando podem ser adicionadas por software, com precisão de reconhecimento de até 99%. Suporta entradas em chinês e inglês, tornando a interação de voz com IA acessível até para iniciantes!

O módulo de voz possui múltiplas interfaces integradas. Sem precisar entender os princípios subjacentes do reconhecimento de voz, é possível gerar facilmente firmware usando o software acompanhante e atualizá-lo via interface Type-C. Além disso, o módulo fornece interfaces serial e IIC, suportando projetos de interação por voz com plataformas como STM32, MSPM0 e Raspberry Pi. Pré-carregamos mais de 110 conjuntos de comandos de interação por voz e fornecemos tutoriais detalhados para o usuário, guias de modificação de firmware e ferramentas de programação para acelerar o desenvolvimento de projetos — tornando-o a escolha ideal para projetos de voz embarcados.

Recursos de Reconhecimento de Voz

O Módulo de Interação de Voz possui 2MB de armazenamento integrado e vem pré-carregado com mais de 110 conjuntos de comandos de interação por voz cobrindo uma ampla gama de cenários. Também suporta configurações de comandos de interação definidas pelo usuário para atender às necessidades personalizadas de aplicação.

  • 1. Zero-Conhecimento Prévio, Fácil de Usar

    Quando um usuário emite um comando de voz, o módulo o reconhece e envia o comando ao controlador principal, que executa diretamente a ação correspondente e aciona o módulo de voz para completar o conteúdo de transmissão. Todo o processo é simples e fácil de usar.

  • 2. Configuração Eficiente, Operação Conveniente

    Os comandos de voz podem ser usados para modificar os comandos de reconhecimento do módulo, permitindo alterações eficientes de palavras de ativação, ajuste de volume e modificação do conteúdo de transmissão.

  • 3. Ampla Biblioteca de Comandos, Pronto para Uso

    Para conveniência do usuário, pré-configuramos mais de 110 comandos de interação por voz cobrindo cenários diversos, encurtando significativamente o ciclo de desenvolvimento e habilitando desenvolvimento eficiente de projetos!

Configuração de Comandos de Reconhecimento de Voz Personalizados

Fornecemos tutoriais completos de modificação de firmware e ferramentas de programação, suportando personalização profunda para atender às necessidades de desenvolvimento secundário.

  • &circled1; Tom de Voz Personalizado

  • &circled2; Vocabulário Personalizado

    Adicione ou modifique palavras de ativação, palavras de comando e frases de transmissão. Configure com flexibilidade protocolos e limiares de confiança.

  • &circled3; Parâmetros Personalizados

    Sensibilidade de reconhecimento (Alta/Média/Baixa), cancelamento de eco (Ativado/Desativado), duração da ativação, modo de saída e outros parâmetros são todos ajustáveis.

  • &circled4; Ferramenta de Programação de Firmware Incluída

    Operação simples com suporte a atualizações de firmware e salvamento de parâmetros. Até iniciantes podem começar rapidamente.

Características Técnicas — Reconhecimento de Voz

  • 01 Reconhecimento Bilíngue Chinês e Inglês, Vocabulário Totalmente Personalizável

    Configure com flexibilidade uma ou múltiplas palavras de ativação para se adequar a diferentes hábitos de usuário e necessidades de cenário. O reconhecimento é rápido e preciso, capturando com precisão comandos de ativação em chinês e inglês, equilibrando precisão e resistência a interferências. Sem configuração complexa — personalização fácil da ativação para uma experiência de interação humano-robô mais intuitiva.

  • 02 Múltiplos Modos de Transmissão de Voz

    Suporta reconhecimento de palavras de ativação com acionamento automático de transmissão de voz, bem como transmissão de voz ativa via controlador host externo. Os dois modos podem ser alternados com flexibilidade.

  • 03 Conversação Natural com Cancelamento de Eco

    Durante a transmissão, palavras de ativação ou comandos podem interromper o processo de reprodução atual, permitindo que o módulo de voz responda instantaneamente e transmita o conteúdo do comando mais recente, entregando uma experiência de interação homem-máquina mais fluida e natural.

Recursos de Hardware — Módulo de Voz

  • 01 Design Integrado, Desenvolvimento Simplificado

    O módulo integra um microfone de redução de ruído de alto desempenho e um alto-falante de alta fidelidade, alcançando funcionalidade integrada de reconhecimento de voz + reprodução de voz. Isso simplifica muito o processo de desenvolvimento e os custos de implantação de hardware de sistemas de interação de voz com IA, permitindo configurar rapidamente soluções de interação por voz sem periféricos de áudio adicionais.

    Alto-falante de alta fidelidade: entrega qualidade de som nítida com reprodução precisa dos detalhes de voz. Versões integradas e externas disponíveis.

    Microfone de redução de ruído de alto desempenho: integra algoritmos avançados de supressão de ruído, alcançando até 99% de precisão de reconhecimento em um alcance de 6m.

  • 02 Módulo de Reconhecimento de Voz de Alta Precisão

    Utilizando algoritmos avançados de supressão de ruído, filtra efetivamente o ruído ambiental de fundo e suporta reconhecimento de palavras de ativação de longo alcance de até 6 metros, garantindo controle de comandos de voz preciso e eficiente com precisão de até 99%.

  • 03 Ampla Compatibilidade, Sem Driver

    Interface Type-C integrada com operação plug-and-play sem driver. Pode ser emparelhado com hosts embarcados como Raspberry Pi via conexão USB, reduzindo o uso de pinos. Compatível com Mac OS, Windows, Linux e outros sistemas operacionais.

  • 04 Suporte a Múltiplos Controladores e Placas de Expansão

    Compatível com controladores convencionais incluindo Raspberry Pi, Jetson e RDK, permitindo expansão de hardware flexível e combinações versáteis. Libere mais possibilidades criativas para seus robôs — tornar ideias em realidade é mais fácil e a interação robótica mais envolvente!

Diagrama de Fiação do Módulo de Voz

1. Módulo de Interação de Voz — Diagrama de Fiação de Comunicação Serial

  • Diagrama do Módulo de Interação de Voz com IA conectado ao Raspberry Pi

  • Diagrama do Módulo de Interação de Voz com IA conectado ao Jetson Orin

2. Módulo de Interação de Voz — Diagrama de Fiação de Comunicação IIC

  • Diagrama do Módulo de Interação de Voz com IA conectado ao Raspberry Pi

  • Diagrama do Módulo de Interação de Voz com IA conectado ao Jetson Orin

3. Módulo de Interação de Voz — Diagrama de Fiação de Comunicação Type-C

Interface Type-C integrada com operação plug-and-play sem driver, conveniente para atualizações de firmware. Pode ser emparelhado com hosts embarcados como Raspberry Pi via conexão USB, reduzindo o uso de pinos.

  • Diagrama do Módulo de Interação de Voz com IA conectado ao Raspberry Pi

  • Diagrama do Módulo de Interação de Voz com IA conectado ao Jetson Orin

Suporte ROS1 e ROS2 do Módulo de Voz com IA

O Módulo de Interação de Voz suporta tanto ROS1 quanto ROS2.

Cenários de Aplicação do Módulo de Voz com IA

Casa inteligente, aplicações de robótica, cães robôs programáveis, soluções de interação por sensores

Interface de Hardware do Módulo de Voz

Nome do Hardware / Descrição

1

Alto-falante — Converte sinais analógicos em som

2

Interruptor Deslizante — Alterna a porta serial para programação de firmware

3

Microfone — Converte som em sinais analógicos

4

Botão RST — Botão de reset

5

Indicador de Alimentação (Vermelho) — Permanece aceso quando a alimentação está normal

6

Interface Type-C — Para alimentação e atualização/download de firmware CI1302/STC8

7

Chip Amplificador de Áudio — Converte sinais digitais em analógicos para acionar o alto-falante

8

Chip CI1302 — Chip de reconhecimento de voz de alto desempenho; reconhece fala e emite sinais

9

Proteção contra Polaridade Inversa — Proteção contra conexão reversa de 5V/GND

10

Interface IIC — Opera como escravo para alimentação e comunicação com o dispositivo host

11

Interface Serial — Porta serial externa para controle de transmissão baseado em protocolo

12

Chip STC8H — Converte comandos do chip de voz em protocolo IIC e comandos seriais

Especificações do Módulo de Voz com IA

Modelo do Chip

CI1302 (ChipIntelli)

Tensão de Alimentação

DC 5V

RAM

640KByte

FLASH

2MByte

Modo de Reconhecimento

Ativação por comando

Método de Comunicação

Comunicação IIC (conexão de 4 pinos ao host), comunicação serial

Faixa de Reconhecimento

Máximo de 6 metros em ambientes silenciosos; 1 metro em ambientes ruidosos

Requisitos de Reconhecimento

Reconhece frases de comando fixas; até 255 frases ou frases curtas suportadas. As frases de reconhecimento podem ser modificadas via firmware.

Quantidade de Comandos Pré-configurados

Mais de 110 frases de comando (até um máximo de 120)

Palavra de Ativação Padrão

"Hello, Little Rhino"

Lista de Peças do Módulo de Voz com IA

Módulo de Interação de Voz

1x (módulo principal)

Cabo de Dados Type-C

1x (para alimentação e comunicação)

Cabo de 4 Pinos PH2.0 (20cm)

1x (para conexão serial)

Cabo PH2.0 de 4 Pinos para Dupont (20cm)

1x (para conexão UART)

Specifications

[{"name":"Wake-up","value":"Keyword wake-up"},{"name":"Languages","value":"Bilingual (EN/CN)"},{"name":"Commands","value":"110+ commands"},{"name":"Interface","value":"UART / USB / I2C"}]

Frequently Asked Questions

What is the AI Voice Recognition Module — Keyword Wake-Up, Bilingual Speech, 110+ Commands?
Visão Geral do Módulo de Interação de Voz com IAMódulo de Interação de Voz com IA— Ativação por Palavra-Chave | Reconhecimento Chinês e Inglês | Vocabulário/Parâmetros PersonalizáveisMais de 110 comandos predefinidos de interação por vozDesign integrado de reconhecimento e reproduçãoSuporte a voc...
Where can I find technical documentation and open-source files for the AI Voice Recognition Module — Keyword Wake-Up, Bilingual Speech, 110+ Commands?
All schematics, CAD files, firmware, and software libraries are available on the JuxiTech Wiki. Everything is fully open-source with permissive licenses.
What platforms and frameworks is the AI Voice Recognition Module — Keyword Wake-Up, Bilingual Speech, 110+ Commands compatible with?
JuxiTech products are designed for ROS 2, LeRobot, HuggingFace, and NVIDIA Jetson ecosystems. See the technical documentation for details.
How can I get technical support for the AI Voice Recognition Module — Keyword Wake-Up, Bilingual Speech, 110+ Commands?
Email support@juxitech.com. Free community support, documentation, and 12-month warranty included. Ships worldwide from Shenzhen, China within 1-3 business days.

Nenhum vídeo

Deep Dive into the Tech → Feishu Wiki

Read technical documentation, schematics, and research papers on feishu.cn/wiki/RhA6wg91hiFZykkcDGoc8wMCnch