Skip to content

oanderoficial/reconhecimento-de-voz

Repository files navigation

🎙️ Reconhecimento de Voz

Python SpeechRecognition pyttsx3

Assistente de voz em Python para abrir atalhos de criptomoedas e fazer buscas na web usando comandos em português. O projeto foi modernizado para uma estrutura instalável, com CLI, tipagem, testes e comandos mais fáceis de manter.

✨ Funcionalidades

  • Reconhecimento de voz em português (pt-BR) com SpeechRecognition.
  • Resposta por voz com pyttsx3.
  • Atalhos para Bitcoin, Ethereum, Mempool, arbitragem, CoinMarketCap, Binance, dólar e TradingView.
  • Busca livre no Google com comandos como pesquisar por mineração de bitcoin.
  • Modo contínuo até dizer sair.
  • Modo digitado (--typed) para testar sem microfone.
  • Listagem de comandos via CLI.
  • Listagem e seleção de microfone/headset por índice.

🚀 Instalação

Requer Python 3.11 ou superior.

python -m venv .venv
source .venv/bin/activate
python -m pip install --upgrade pip
pip install -e .[voice]

No Linux, o PyAudio pode exigir bibliotecas do sistema antes da instalação:

sudo apt-get install portaudio19-dev python3-dev

Para desenvolvimento/testes:

pip install -e .[dev]

▶️ Como usar

Execute como usuário normal, não com sudo/root, para evitar problemas de permissão, áudio e abertura do navegador.

Executar pelo script principal

Se você clonou o projeto e está dentro da pasta do repositório, ative o ambiente virtual e rode:

source .venv/bin/activate
python script.py

Se quiser informar diretamente o headset/microfone, primeiro liste os dispositivos:

python script.py --list-microphones

Depois execute com o índice desejado:

python script.py --microphone-index 8 --timeout 8 --phrase-time-limit 4 --recognition-timeout 12

Para testar sem usar o microfone:

python script.py --typed --no-speech

Exemplo de como usar

.venv/bin/python -m voice_assistant --microphone-index 8 --timeout 8 --phrase-time-limit 4 --recognition-timeout 12

Executar pela CLI instalada

Após instalar com pip install -e .[voice], você também pode executar com o comando:

assistente-voz

Executar em modo contínuo:

assistente-voz --continuous

Testar pelo teclado, sem microfone e sem áudio de saída:

assistente-voz --typed --no-speech

Listar comandos disponíveis:

assistente-voz --list-commands

Listar microfones detectados:

assistente-voz --list-microphones

Usar um headset específico:

assistente-voz --microphone-index 2 --no-speech

Se o reconhecimento online demorar, ajuste o limite da chamada:

assistente-voz --microphone-index 2 --no-speech --recognition-timeout 10

Por padrão, a chamada ao Google Speech Recognition força IPv4 para evitar travamentos em redes com IPv6 mal configurado. Para desativar:

assistente-voz --no-force-ipv4

Também é possível executar como módulo:

python -m voice_assistant --typed --no-speech

O arquivo script.py continua existindo como compatibilidade com a versão antiga, mas agora delega para a CLI moderna.

🗣️ Exemplos de comandos

  • abrir cotação do bitcoin
  • preço ethereum
  • abrir mempool
  • arbitragem cripto
  • abrir binance
  • cotação dólar
  • gráficos de criptomoedas
  • pesquisar por melhores carteiras bitcoin
  • ajuda
  • sair

🧪 Qualidade

ruff check .
pytest

📁 Estrutura

.
├── pyproject.toml
├── script.py
├── src/
│   └── voice_assistant/
│       ├── __init__.py
│       ├── __main__.py
│       └── app.py
└── tests/
    └── test_command_registry.py

🖼️ Imagens

image image

About

Programa em Python que faz o reconhecimento de Voz usando a biblioteca SpeechRecognition e o pyttsx3 para conversão de texto em fala, junto com o webbrowser para abrir o resultado no browser. O programa pesquisa de forma automática a cotação do Bitcoin, Mempool, Arbitragem, Cotação das Criptomoedas, etc. Utilizando comandos de voz pré definidos.

Topics

Resources

Stars

Watchers

Forks

Releases

Packages

Used by

Contributors

Languages