사용 설명서

dicto는 당신이 말하거나 입력한 내용을 크고 또렷한 텍스트로 표시합니다. 이 설명서는 앱의 작동 방식을 설명합니다.

목차

시작하기

dicto를 처음 실행하면 기본 말하기 언어와 색상 구성을 선택하는 짧은 초기 설정 과정을 거칩니다. 두 가지 모두 설정에서 언제든지 변경할 수 있습니다. 이 설정 화면 뒤에는 앱 기능에 대한 기본 안내 화면 세 개가 이어지며, 건너뛸 수 있습니다.

마이크 버튼을 처음 누르면 iOS가 접근 권한 화면을 표시하여 기기의 음성 인식과 마이크에 대한 접근 권한을 요청합니다. 두 가지 모두 Apple 서비스이며, dicto가 말한 내용을 텍스트로 표시하려면 필요합니다. 허용을 탭하세요. 나중에 접근을 허용하려면 iOS 설정 앱을 열고 설정 ▸ dicto로 이동하여 마이크음성 인식을 켜세요.

기본 화면

기본 화면에는 현재 메시지와 메시지를 만들고, 지우고, 다시 보는 컨트롤이 표시됩니다. 세로 방향은 약간 더 큰 텍스트를 보여 주고(짧은 메시지에 적합), 가로 방향은 더 긴 텍스트를 보여 줍니다(조금 더 길거나 맥락이 있는 메시지에 적합).

말하기 및 받아쓰기

마이크 버튼을 탭하거나 메시지 표시 영역을 두 번 탭하면 받아쓰기가 시작됩니다. 평소처럼 말하면 말하는 대로 단어가 나타납니다. 받아쓰기가 잘 되지 않으면(문장이 제대로 끝나지 않으면) 설정 메뉴의 말하기 속도 설정으로 빠르거나 느린 화자에 맞게 조정하면 도움이 될 수 있습니다.

기본적으로 약 1초의 멈춤이 문장을 끝내고, dicto가 마침표나 물음표를 붙인 뒤 계속 듣습니다. 약 2초의 멈춤은 현재의 말차례를 끝내고 최종 텍스트를 표시하며, 기본 화면 아래로 이어지는 메시지는 자동으로 스크롤됩니다. 메시지는 직접 스크롤할 수도 있고, 설정 메뉴에서 자동 스크롤을 끌 수 있습니다. dicto가 멈춤에서 얼마나 기다릴지는 설정말하기 속도로 조정합니다. Solo 세션은 약 1분 30초 후 자동으로 멈추므로, 시끄러운 방에서 마이크가 계속 열려 있지 않습니다. Solo의 문장 구분 시간도 말하기 속도 설정으로 정해집니다.

받아쓰기는 Apple의 음성 인식으로 제공되며 완벽하지 않습니다. 억양, 배경 소음, 흔하지 않은 이름, 아주 짧은 표현, 여러 사람이 동시에 말하는 상황은 잘못 인식될 수 있습니다. 자연스러운 속도로 또렷하게 말하고 화자에 맞는 말하기 속도 설정을 사용하면 가장 좋은 결과를 얻을 수 있습니다.

화면의 텍스트를 지우려면 화면 아래쪽의 지우기를 누르세요. 지우기를 길게 누르면 새 세션을 시작하시겠습니까? 대화상자가 나타납니다. 새로 시작을 누르면 dicto가 초기화되고 이전 항목 영역도 지워집니다.

Solo

Solo는 음성 분리 기술로 dicto를 등록된 한 사람의 목소리에 집중시켜, 그 화자의 말을 표시하고 주변의 다른 목소리는 무시하도록 설계되었습니다. Solo에서는 손을 쓰지 않고 사용할 수 있습니다. 다른 목소리의 말은 표시되지 않으며 변환되지도 않습니다. Solo는 조용하거나 소음이 보통인 공간에서 한 번에 한 사람이 말할 때 가장 잘 작동합니다. dicto가 어떤 목소리를 등록된 목소리로 확신하지 못하면 아무것도 표시하지 않습니다. 빠르게 말한 세 단어 미만의 짧은 표현은 식별하기에 너무 짧아 화면에 나타나지 않을 수 있습니다(예: “안녕하세요”, “좋네요”).

Solo 작동 방식

Solo가 켜져 있는 동안 dicto는 공간의 소리를 듣고, 이어지는 각 발화를 단어가 아니라 목소리의 음향을 나타내는 소수의 숫자로 바꿉니다. 이 숫자를 등록할 때 얻은 숫자와 비교합니다. 등록된 목소리와 일치하는 발화는 변환되어 표시되고, 일치하지 않는 발화는 텍스트로 바뀌기 전에 폐기됩니다. 비교는 앱에 내장되어 전적으로 기기에서 실행되는 작은 머신러닝 모델이 수행합니다. 클라우드 서비스도, 계정도, 연결도 필요하지 않습니다. 발화는 결코 보관되거나 녹음되지 않습니다.

목소리 등록하기

  1. 마이크 버튼을 길게 누른 채 자연스럽게 말하세요. 누르고 있는 동안 말한 내용이 일반 메시지로 표시됩니다.
  2. 패널에 등록 진행 상황이 표시됩니다. 기본적인 구분에 필요한 만큼 목소리가 확보될 때까지 막대는 빨간색입니다.
  3. 실제 발화가 약 3초에 이르면 막대가 노란색으로 바뀌고 소리가 울립니다. 기본 등록이 성공했다는 뜻이며, 언제든 버튼에서 손을 떼도 됩니다.
  4. 버튼을 계속 누르고 있으면 등록의 정확도가 높아지며, 실제 발화 10초에서 완전한 등록이 됩니다. 목소리가 더 확보될수록 막대는 노란색에서 초록색으로 옮겨 가며, 약 10초에서 초록색이 됩니다. 완전한 등록은 화면 전체가 빛나는 Solo Glow로 표시됩니다.
  5. 버튼에서 손을 떼세요. Solo가 등록된 목소리를 듣기 시작합니다. 등록이 성공하면 마이크 아이콘이 Solo 아이콘, 즉 청록색 실선 원 테두리가 있는 사람과 음성 막대 아이콘으로 바뀝니다.

버튼을 놓았을 때 확보된 목소리가 너무 적으면 dicto는 약 2초 더 듣고, 그래도 등록을 완료할 수 없으면 현재 등록을 취소합니다.

등록 보완과 Solo Glow

기본 등록만으로도 시작할 수 있으며, 나머지는 dicto가 조용히 마무리합니다. 세션 중에 등록된 목소리와 분명히 일치하는 발화가 등록에 추가되어, 대화가 이어질수록 정확도가 높아집니다. 이를 등록 보완이라고 합니다. 등록된 목소리만 사용하며 다른 발화는 사용하지 않습니다. 버튼을 눌러 초록색 막대까지 채우든, 대화 중 보완을 통해서든 등록이 최대치에 이르면 Solo Glow가 나타납니다. 화면 전체가 짧고 조용하게 빛나는 효과로, dicto가 목소리를 완전히 등록했다는 뜻입니다. 나타나더라도 따로 할 일은 없습니다.

세션 중

등록된 목소리는 말하기 속도 설정에 따라 한 번에 한 메시지씩 표시됩니다. 다른 목소리는 화면에 아무것도 남기지 않습니다. Solo 세션이 진행되는 동안에는 이전 항목이 숨겨집니다. 마이크 버튼을 탭하면 듣기를 일시정지하거나 다시 시작할 수 있으며, 공간이 약 30초 동안 조용하면 세션은 스스로 일시정지합니다. 일시정지된 Solo 세션은 청록색 실선이 점선으로 바뀌어 표시됩니다. 현재 세션을 다시 활성화하려면 Solo 버튼을 탭하세요.

세션 종료

지우기 버튼을 길게 누르고 새로 시작을 확인하면 현재 텍스트와 등록된 목소리가 지워지며, “세션이 지워졌습니다”라는 짧은 알림으로 확인할 수 있습니다. 등록된 목소리가 약 3분 동안 들리지 않거나 앱이 백그라운드로 이동하면 세션은 스스로 종료됩니다. 세션 중에 마이크 버튼을 길게 누르면 등록된 목소리 대신 다른 목소리를 등록할 수 있습니다.

목소리 프로필

목소리 일치는 앱에 내장되어 전적으로 기기에서 실행되는 작은 머신러닝 모델이 수행합니다. 클라우드 서비스도, 계정도, 연결도 없습니다. 모델은 목소리를 비교할 뿐입니다. 등록 자체는 목소리를 분류하는 데 쓰이는 소수의 숫자로, 세션이 지속되는 동안에만 메모리에 보관됩니다. 저장되지 않고, 어디로도 전송되지 않으며, 세션이 끝나면 사라집니다.

목소리 일치 모델은 pyannote community-1 화자 모델(WeSpeaker 계열)로, FluidInference가 Core ML로 변환했으며 Creative Commons Attribution 4.0 라이선스에 따라 사용합니다.

입력

키보드 버튼을 탭하면 텍스트 입력이 열립니다. 메시지를 입력하거나 붙여 넣은 다음 완료를 탭하면(또는 키보드의 파란색 확인 버튼을 누르면) 기본 화면에 표시되고, 취소를 탭하면 현재 메시지를 바꾸지 않고 닫힙니다.

속삭임 모드

속삭임 모드는 사라지는 메시지 기능을 켜고 끕니다. 설정에서 속삭임 모드를 켜면 Wisps를 보낼 수 있습니다. 화면에 나타나 몇 초간 머문 뒤 영원히 사라지는 메시지입니다. Wisps이전 항목에 절대 저장되지 않으며, 속삭임 모드가 켜져 있는 동안 이전 항목은 숨겨집니다. 속삭임 모드가 켜져 있는 동안에는 자동 스크롤도 꺼집니다.

소리 내어 읽기

오른쪽 위의 소리 내어 읽기 버튼을 탭하면 현재 표시된 메시지를 소리 내어 읽어 줍니다. 화면에 메시지가 없으면 이 버튼은 사용할 수 없습니다. 읽어 주는 음성은 설정음성에서 지정하며, iOS 설정 앱의 손쉬운 사용 ▸ 콘텐츠 말하기 ▸ 음성에서 음성을 추가할 수 있습니다(Siri가 아닙니다).

설정

설정 버튼(왼쪽 위 톱니바퀴)을 탭하면 설정 메뉴가 열립니다.

개인정보 및 데이터

dicto는 모든 것을 당신의 기기에서 처리합니다. 당신이 말하거나 입력한 것은 당사로 전송되지 않으며, 앱을 닫으면 아무것도 저장되지 않습니다. 자세한 내용은 개인정보 처리방침을 참고하세요.

지원

질문, 문제, 의견이 있으신가요? support@speechdisplay.com로 메일을 보내 주세요. 기꺼이 도와드리겠습니다.

홈으로 돌아가기