Guia de uso

O dicto exibe o que você fala ou digita como texto grande e nítido. Este guia descreve como o app funciona.

Índice

Primeiros passos

Na primeira vez que o dicto é aberto, o usuário passa por uma breve etapa de introdução em que escolhe o idioma falado padrão e o esquema de cores. Os dois podem ser alterados em Ajustes a qualquer momento. Depois dessas telas de preferências vêm três telas com instruções básicas sobre os recursos do app, que podem ser puladas.

Na primeira vez que o botão do microfone é pressionado, o iOS pede permissão para acessar o Reconhecimento de Fala e o Microfone do seu aparelho, apresentando as telas de Permissões de acesso. Os dois são serviços da Apple e o dicto precisa deles para mostrar sua fala como texto. Toque em Permitir; para liberar o acesso depois, abra o app Ajustes do iOS, vá em Ajustes ▸ dicto e ative Microfone e Reconhecimento de Fala.

A tela principal

A tela principal exibe a mensagem atual e os controles para criar, apagar e revisitar mensagens. A orientação retrato apresenta um texto um pouco maior (bom para mensagens curtas), e a orientação paisagem apresenta um texto mais longo (bom para mensagens um pouco mais longas ou contextuais).

Fala e ditado

Inicie o ditado tocando no botão do microfone ou tocando duas vezes na área de exibição da mensagem. Fale normalmente; as palavras aparecem conforme você as diz. Se o ditado não estiver funcionando bem (frases que não terminam direito), existe o ajuste Ritmo da fala para quem fala mais rápido ou mais devagar, no menu Ajustes, que pode ajudar.

Por padrão, uma pausa de cerca de um segundo encerra uma frase; então o dicto acrescenta um ponto final ou de interrogação e continua ouvindo. Uma pausa de cerca de dois segundos encerra o turno de fala atual e exibe o texto final, rolando automaticamente para mensagens que se estendem abaixo da tela principal. As mensagens também podem ser roladas manualmente, e a rolagem automática pode ser desativada no menu Ajustes. Ajuste quanto o dicto espera nas pausas com Ritmo da fala em Ajustes. Uma sessão do Solo para automaticamente depois de cerca de um minuto e meio, para que o microfone não fique aberto em uma sala barulhenta. Os tempos das frases no Solo também são definidos pelo ajuste Ritmo da fala.

O ditado é fornecido pelo reconhecimento de fala da Apple e não é perfeito. Sotaques, ruído de fundo, nomes pouco comuns, frases muito curtas e pessoas falando ao mesmo tempo podem ser entendidos errado. Falar com clareza em um ritmo natural e usar o ajuste Ritmo da fala correspondente a quem fala dá os melhores resultados.

Para apagar o texto da tela, pressione a palavra Apagar na parte de baixo da tela. Manter a palavra Apagar pressionada abre a caixa Começar uma nova sessão?. Pressione Começar de novo para reiniciar o dicto e limpar a seção ANTERIORES.

Solo

O Solo usa tecnologia de isolamento de voz para focar o dicto em uma voz registrada - pensado para mostrar as palavras dessa pessoa e ignorar outras vozes por perto. O Solo permite o uso sem as mãos. A fala de outras vozes não é exibida e nunca é transcrita. O Solo funciona melhor com uma pessoa falando por vez, em uma sala silenciosa ou com ruído moderado; quando o dicto não tem certeza de que uma voz é a registrada, ele não mostra nada. Frases com menos de três palavras ditas rapidamente podem ser curtas demais para serem identificadas (por exemplo, "Oi", "Que ótimo") e podem não aparecer na tela.

Como o Solo funciona

Enquanto o Solo está ativo, o dicto escuta a sala e transforma cada trecho de fala em um pequeno conjunto de números que descrevem o som da voz, não as palavras. Esses números são comparados com os números capturados no registro. A fala que corresponde à voz registrada é transcrita e exibida; a fala que não corresponde é descartada sem nunca virar texto. A comparação roda em pequenos modelos de aprendizado de máquina que vêm dentro do app e funcionam inteiramente no aparelho; nenhum serviço de nuvem, conta ou conexão está envolvido. Nenhuma fala é guardada ou gravada, nunca.

Registrar uma voz

  1. Mantenha o botão do microfone pressionado e fale naturalmente. O que você disser enquanto o mantém pressionado é exibido como uma mensagem normal.
  2. Um painel mostra o andamento do registro. A barra fica vermelha até que voz suficiente tenha sido capturada para uma separação básica.
  3. Com cerca de três segundos de fala efetiva, a barra fica amarela e um tom é tocado: o registro básico deu certo e o botão pode ser solto a qualquer momento.
  4. Continuar segurando o botão melhora o registro, até dez segundos de fala efetiva para um registro completo. A barra passa do amarelo ao verde conforme mais voz é capturada, chegando ao verde com cerca de dez segundos. O registro completo é indicado pelo Solo Glow, um efeito de brilho em tela cheia.
  5. Solte o botão. O Solo começa a ouvir em busca da voz registrada. O registro bem-sucedido é indicado pelo ícone do microfone virando o ícone do Solo: o ícone de uma pessoa com barras de fala e um contorno circular contínuo azul-petróleo.

Se pouca voz foi capturada quando o botão é solto, o dicto ouve por cerca de dois segundos a mais e depois cancela o registro atual, caso ele ainda não possa ser concluído.

Complemento do registro e o Solo Glow

Um registro básico já basta para começar, e o dicto termina o trabalho sozinho, discretamente. Durante uma sessão, os momentos de fala que correspondem inequivocamente à voz registrada são acrescentados ao registro, melhorando a precisão conforme a conversa avança. Isso se chama complemento do registro; ele usa apenas a voz registrada, nunca outra fala. Quando o registro atinge seu tamanho completo - seja segurando o botão até a barra verde, seja pelo complemento durante a conversa - aparece o Solo Glow: um brilho breve, silencioso e em tela cheia que significa que o dicto registrou a voz por completo. Não é preciso fazer nada quando ele aparece.

Durante uma sessão

A voz registrada é exibida uma mensagem por vez, usando os tempos do Ritmo da fala. Outras vozes não produzem nada na tela. Anteriores fica oculto enquanto uma sessão do Solo está ativa. Toque no botão do microfone para pausar ou retomar a escuta; a sessão também pausa sozinha depois de cerca de trinta segundos de silêncio na sala. Uma sessão do Solo pausada é indicada pela linha contínua azul-petróleo virando tracejada. Para reativar a sessão atual, toque no botão do Solo.

Encerrar uma sessão

Mantenha o botão Apagar pressionado e confirme em Começar de novo para apagar o texto atual e a voz registrada; um breve aviso "Sessão apagada" confirma a exclusão. Uma sessão também termina sozinha depois de cerca de três minutos sem a voz registrada, ou quando o app vai para segundo plano. Mantenha o botão do microfone pressionado durante uma sessão para registrar uma voz diferente no lugar da atual.

O perfil de voz

A correspondência de voz roda em pequenos modelos de aprendizado de máquina que vêm dentro do app e funcionam inteiramente no seu aparelho. Não há serviço de nuvem, conta nem conexão envolvidos; os modelos comparam vozes, e nada mais. O registro em si é um pequeno conjunto de números usado para classificar uma voz, mantido na memória pelo tempo da sessão: nunca salvo, nunca enviado a lugar algum, e apagado quando a sessão termina.

Os modelos de correspondência de voz são os modelos de locutor pyannote community-1 (família WeSpeaker), convertidos para Core ML pela FluidInference e usados sob a licença Creative Commons Attribution 4.0.

Digitação

Toque no botão do teclado para abrir Digitar texto. Digite ou cole uma mensagem e toque em Concluído (ou pressione o botão azul de confirmação no teclado) para exibi-la na tela principal, ou em Cancelar para fechar sem alterar a mensagem atual.

Modo sussurro

O Modo sussurro ativa ou desativa a função de mensagens que desaparecem. Ative o Modo sussurro em Ajustes para enviar Wisps: mensagens que aparecem na tela, permanecem por alguns segundos e depois somem para sempre. Os Wisps nunca são salvos em Anteriores, que fica oculto enquanto o Modo sussurro está ativado. A rolagem automática também é desativada enquanto o Modo sussurro está ativado.

Ler em voz alta

Toque no botão Ler em voz alta no canto superior direito para que a mensagem exibida seja lida em voz alta. O botão fica indisponível quando não há mensagem na tela. A voz de leitura é definida em Voz nos Ajustes; é possível adicionar mais vozes no app Ajustes do iOS, em Acessibilidade ▸ Conteúdo falado ▸ Vozes (não a Siri).

Ajustes

Toque no botão Ajustes (a engrenagem, no canto superior esquerdo) para abrir o menu de Ajustes.

Privacidade e dados

O dicto processa tudo no seu dispositivo. Nada do que você fala ou digita é enviado a nós, e nada é guardado depois que você fecha o app. Para todos os detalhes, consulte a Política de Privacidade.

Suporte

Dúvidas, problemas ou sugestões? Escreva para support@speechdisplay.com - teremos prazer em ajudar.

Voltar ao início