사용 설명서
dicto는 당신이 말하거나 입력한 내용을 크고 또렷한 텍스트로 표시합니다. 이 설명서는 앱의 작동 방식을 설명합니다.
목차
시작하기
dicto를 처음 실행하면 기본 말하기 언어와 색상 구성을 선택하는 짧은 초기 설정 과정을 거칩니다. 두 가지 모두 설정에서 언제든지 변경할 수 있습니다. 이 설정 화면 뒤에는 앱 기능에 대한 기본 안내 화면 세 개가 이어지며, 건너뛸 수 있습니다.
마이크 버튼을 처음 누르면 iOS가 접근 권한 화면을 표시하여 기기의 음성 인식과 마이크에 대한 접근 권한을 요청합니다. 두 가지 모두 Apple 서비스이며, dicto가 말한 내용을 텍스트로 표시하려면 필요합니다. 허용을 탭하세요. 나중에 접근을 허용하려면 iOS 설정 앱을 열고 설정 ▸ dicto로 이동하여 마이크와 음성 인식을 켜세요.
기본 화면
기본 화면에는 현재 메시지와 메시지를 만들고, 지우고, 다시 보는 컨트롤이 표시됩니다. 세로 방향은 약간 더 큰 텍스트를 보여 주고(짧은 메시지에 적합), 가로 방향은 더 긴 텍스트를 보여 줍니다(조금 더 길거나 맥락이 있는 메시지에 적합).
- 메시지 표시 영역: 화면 안내를 보여 주고, 현재 메시지를 사용 가능한 공간이 허락하는 만큼 크게, 말하는 동안 실시간으로 갱신하며 표시합니다. 이 영역을 두 번 탭하면 받아쓰기를 시작하거나 중지합니다. 길게 누르면 현재 메시지를 편집합니다. 긴 메시지는 자동으로 스크롤되며, 설정에서 수동 스크롤로 바꿀 수 있습니다.
- 마이크 버튼: 음성 메시지를 시작하거나 중지합니다. 말하기 & 받아쓰기를 참고하세요. 길게 누르면 Solo에서 등록을 시작합니다.
- 키보드 버튼: 말하는 대신 키보드를 열어 메시지를 입력하거나 붙여넣습니다. 입력을 참고하세요.
- 지우기 버튼: 현재 메시지를 지웁니다. 지운 메시지는 이전 항목에 저장되지 않습니다. 지우기 버튼을 길게 누르면 “새 세션을 시작하시겠습니까?” 대화상자가 나타나 앱을 초기화합니다.
- 이전 항목: 화면 아래쪽에 늘어선, 완료된 메시지의 띠입니다. 지우지 않은 메시지는 새 메시지를 시작할 때 이전 항목 영역에 추가됩니다. 메시지를 탭하면 다시 표시됩니다. 이전 항목은 앱을 닫으면 지워지며, 속삭임 모드가 켜져 있거나 Solo 세션이 진행 중일 때는 사용할 수 없습니다.
- 소리 내어 읽기 버튼: 설정에서 선택한 음성으로 현재 메시지를 소리 내어 읽습니다. 소리 내어 읽기를 참고하세요.
- 설정 버튼: 설정 화면을 엽니다. 여기서 언어, 색상 구성, 말하기 속도, 속삭임 모드 같은 환경설정을 지정합니다. 설정을 참고하세요.
말하기 및 받아쓰기
마이크 버튼을 탭하거나 메시지 표시 영역을 두 번 탭하면 받아쓰기가 시작됩니다. 평소처럼 말하면 말하는 대로 단어가 나타납니다. 받아쓰기가 잘 되지 않으면(문장이 제대로 끝나지 않으면) 설정 메뉴의 말하기 속도 설정으로 빠르거나 느린 화자에 맞게 조정하면 도움이 될 수 있습니다.
기본적으로 약 1초의 멈춤이 문장을 끝내고, dicto가 마침표나 물음표를 붙인 뒤 계속 듣습니다. 약 2초의 멈춤은 현재의 말차례를 끝내고 최종 텍스트를 표시하며, 기본 화면 아래로 이어지는 메시지는 자동으로 스크롤됩니다. 메시지는 직접 스크롤할 수도 있고, 설정 메뉴에서 자동 스크롤을 끌 수 있습니다. dicto가 멈춤에서 얼마나 기다릴지는 설정의 말하기 속도로 조정합니다. Solo 세션은 약 1분 30초 후 자동으로 멈추므로, 시끄러운 방에서 마이크가 계속 열려 있지 않습니다. Solo의 문장 구분 시간도 말하기 속도 설정으로 정해집니다.
받아쓰기는 Apple의 음성 인식으로 제공되며 완벽하지 않습니다. 억양, 배경 소음, 흔하지 않은 이름, 아주 짧은 표현, 여러 사람이 동시에 말하는 상황은 잘못 인식될 수 있습니다. 자연스러운 속도로 또렷하게 말하고 화자에 맞는 말하기 속도 설정을 사용하면 가장 좋은 결과를 얻을 수 있습니다.
화면의 텍스트를 지우려면 화면 아래쪽의 지우기를 누르세요. 지우기를 길게 누르면 새 세션을 시작하시겠습니까? 대화상자가 나타납니다. 새로 시작을 누르면 dicto가 초기화되고 이전 항목 영역도 지워집니다.
Solo
Solo는 음성 분리 기술로 dicto를 등록된 한 사람의 목소리에 집중시켜, 그 화자의 말을 표시하고 주변의 다른 목소리는 무시하도록 설계되었습니다. Solo에서는 손을 쓰지 않고 사용할 수 있습니다. 다른 목소리의 말은 표시되지 않으며 변환되지도 않습니다. Solo는 조용하거나 소음이 보통인 공간에서 한 번에 한 사람이 말할 때 가장 잘 작동합니다. dicto가 어떤 목소리를 등록된 목소리로 확신하지 못하면 아무것도 표시하지 않습니다. 빠르게 말한 세 단어 미만의 짧은 표현은 식별하기에 너무 짧아 화면에 나타나지 않을 수 있습니다(예: “안녕하세요”, “좋네요”).
Solo 작동 방식
Solo가 켜져 있는 동안 dicto는 공간의 소리를 듣고, 이어지는 각 발화를 단어가 아니라 목소리의 음향을 나타내는 소수의 숫자로 바꿉니다. 이 숫자를 등록할 때 얻은 숫자와 비교합니다. 등록된 목소리와 일치하는 발화는 변환되어 표시되고, 일치하지 않는 발화는 텍스트로 바뀌기 전에 폐기됩니다. 비교는 앱에 내장되어 전적으로 기기에서 실행되는 작은 머신러닝 모델이 수행합니다. 클라우드 서비스도, 계정도, 연결도 필요하지 않습니다. 발화는 결코 보관되거나 녹음되지 않습니다.
목소리 등록하기
- 마이크 버튼을 길게 누른 채 자연스럽게 말하세요. 누르고 있는 동안 말한 내용이 일반 메시지로 표시됩니다.
- 패널에 등록 진행 상황이 표시됩니다. 기본적인 구분에 필요한 만큼 목소리가 확보될 때까지 막대는 빨간색입니다.
- 실제 발화가 약 3초에 이르면 막대가 노란색으로 바뀌고 소리가 울립니다. 기본 등록이 성공했다는 뜻이며, 언제든 버튼에서 손을 떼도 됩니다.
- 버튼을 계속 누르고 있으면 등록의 정확도가 높아지며, 실제 발화 10초에서 완전한 등록이 됩니다. 목소리가 더 확보될수록 막대는 노란색에서 초록색으로 옮겨 가며, 약 10초에서 초록색이 됩니다. 완전한 등록은 화면 전체가 빛나는 Solo Glow로 표시됩니다.
- 버튼에서 손을 떼세요. Solo가 등록된 목소리를 듣기 시작합니다. 등록이 성공하면 마이크 아이콘이 Solo 아이콘, 즉 청록색 실선 원 테두리가 있는 사람과 음성 막대 아이콘으로 바뀝니다.
버튼을 놓았을 때 확보된 목소리가 너무 적으면 dicto는 약 2초 더 듣고, 그래도 등록을 완료할 수 없으면 현재 등록을 취소합니다.
등록 보완과 Solo Glow
기본 등록만으로도 시작할 수 있으며, 나머지는 dicto가 조용히 마무리합니다. 세션 중에 등록된 목소리와 분명히 일치하는 발화가 등록에 추가되어, 대화가 이어질수록 정확도가 높아집니다. 이를 등록 보완이라고 합니다. 등록된 목소리만 사용하며 다른 발화는 사용하지 않습니다. 버튼을 눌러 초록색 막대까지 채우든, 대화 중 보완을 통해서든 등록이 최대치에 이르면 Solo Glow가 나타납니다. 화면 전체가 짧고 조용하게 빛나는 효과로, dicto가 목소리를 완전히 등록했다는 뜻입니다. 나타나더라도 따로 할 일은 없습니다.
세션 중
등록된 목소리는 말하기 속도 설정에 따라 한 번에 한 메시지씩 표시됩니다. 다른 목소리는 화면에 아무것도 남기지 않습니다. Solo 세션이 진행되는 동안에는 이전 항목이 숨겨집니다. 마이크 버튼을 탭하면 듣기를 일시정지하거나 다시 시작할 수 있으며, 공간이 약 30초 동안 조용하면 세션은 스스로 일시정지합니다. 일시정지된 Solo 세션은 청록색 실선이 점선으로 바뀌어 표시됩니다. 현재 세션을 다시 활성화하려면 Solo 버튼을 탭하세요.
세션 종료
지우기 버튼을 길게 누르고 새로 시작을 확인하면 현재 텍스트와 등록된 목소리가 지워지며, “세션이 지워졌습니다”라는 짧은 알림으로 확인할 수 있습니다. 등록된 목소리가 약 3분 동안 들리지 않거나 앱이 백그라운드로 이동하면 세션은 스스로 종료됩니다. 세션 중에 마이크 버튼을 길게 누르면 등록된 목소리 대신 다른 목소리를 등록할 수 있습니다.
목소리 프로필
목소리 일치는 앱에 내장되어 전적으로 기기에서 실행되는 작은 머신러닝 모델이 수행합니다. 클라우드 서비스도, 계정도, 연결도 없습니다. 모델은 목소리를 비교할 뿐입니다. 등록 자체는 목소리를 분류하는 데 쓰이는 소수의 숫자로, 세션이 지속되는 동안에만 메모리에 보관됩니다. 저장되지 않고, 어디로도 전송되지 않으며, 세션이 끝나면 사라집니다.
목소리 일치 모델은 pyannote community-1 화자 모델(WeSpeaker 계열)로, FluidInference가 Core ML로 변환했으며 Creative Commons Attribution 4.0 라이선스에 따라 사용합니다.
입력
키보드 버튼을 탭하면 텍스트 입력이 열립니다. 메시지를 입력하거나 붙여 넣은 다음 완료를 탭하면(또는 키보드의 파란색 확인 버튼을 누르면) 기본 화면에 표시되고, 취소를 탭하면 현재 메시지를 바꾸지 않고 닫힙니다.
속삭임 모드
속삭임 모드는 사라지는 메시지 기능을 켜고 끕니다. 설정에서 속삭임 모드를 켜면 Wisps를 보낼 수 있습니다. 화면에 나타나 몇 초간 머문 뒤 영원히 사라지는 메시지입니다. Wisps는 이전 항목에 절대 저장되지 않으며, 속삭임 모드가 켜져 있는 동안 이전 항목은 숨겨집니다. 속삭임 모드가 켜져 있는 동안에는 자동 스크롤도 꺼집니다.
소리 내어 읽기
오른쪽 위의 소리 내어 읽기 버튼을 탭하면 현재 표시된 메시지를 소리 내어 읽어 줍니다. 화면에 메시지가 없으면 이 버튼은 사용할 수 없습니다. 읽어 주는 음성은 설정의 음성에서 지정하며, iOS 설정 앱의 손쉬운 사용 ▸ 콘텐츠 말하기 ▸ 음성에서 음성을 추가할 수 있습니다(Siri가 아닙니다).
설정
설정 버튼(왼쪽 위 톱니바퀴)을 탭하면 설정 메뉴가 열립니다.
- 속삭임 모드: 사라지는 메시지를 켜고 끕니다. 속삭임 모드를 참고하세요.
- 말하기 속도: 빠름, 보통 또는 느림. dicto가 문장이나 메시지를 끝내기 위해 멈춤에서 얼마나 기다릴지 조정합니다. 문장이 나뉘지 않으면 빠름으로, 문장이 잘리면 느림으로 설정하세요.
- Solo 목소리 일치: 엄격, 균형, 느슨. Solo에서 표시되려면 목소리가 등록된 목소리와 얼마나 가깝게 일치해야 하는지 조정합니다. 다음 등록부터 적용됩니다. 공간 안의 목소리가 서로 비슷할 때는 엄격을 선택하세요.
- 대화 거리(iPad 전용): 가까이(작은 글꼴)와 멀리(큰 글꼴) 대화에 맞춰 글꼴 크기를 조정합니다.
- 긴 메시지 자동 스크롤: 켜면 긴 메시지가 읽기 좋은 속도로 끝까지 갔다가 되돌아옵니다. 끄면 메시지 자동 스크롤이 멈춥니다. 메시지는 언제든 직접 스크롤할 수 있습니다.
- 열 때 입력: 음성은 첫 메시지를 위해 dicto를 듣기 모드로 열어 빠른 대화 상대처럼 사용하게 하고, 수동은 일반 화면으로 dicto를 열어 첫 메시지를 음성이나 텍스트로 입력할 수 있게 합니다.
- 음성: 소리 내어 읽기에 사용되는 음성입니다.
- 색상 구성: 원하는 표시 색상을 선택합니다. 시스템, 밝게, 어둡게 옵션과 고대비 조합인 흰색 바탕에 검정, 검정 바탕에 흰색, 파랑 바탕에 노랑, 검정 바탕에 초록, 검정 바탕에 주황, 흰색 바탕에 진홍, 검정 바탕에 네온 핑크, 초록 바탕에 흰색이 있습니다. 모든 색상 조합이 WCAG AA 대비 접근성 기준을 충족하며, dicto가 표시하는 큰 크기에서는 모든 조합이 AAA를 충족합니다.
- 언어: 받아쓰기를 위해 말하는 언어입니다(앱의 표시 언어가 아닙니다). dicto는 Apple의 기기 내 받아쓰기를 바탕으로 50개 이상의 말하기 언어를 지원합니다. 기기가 지원하기만 하면 사용자 인터페이스 언어와 관계없이 어떤 언어든 선택해 사용할 수 있습니다(예: 영어 인터페이스에서 중국어 받아쓰기를 사용할 수 있습니다). 받아쓰기 언어 목록을 참고하세요. dicto 인터페이스 자체는 14개 언어로 제공됩니다. 인터페이스 언어를 참고하세요.
- dicto 정보: 앱 버전, 짧은 설명, 이 사이트로의 링크.
개인정보 및 데이터
dicto는 모든 것을 당신의 기기에서 처리합니다. 당신이 말하거나 입력한 것은 당사로 전송되지 않으며, 앱을 닫으면 아무것도 저장되지 않습니다. 자세한 내용은 개인정보 처리방침을 참고하세요.
지원
질문, 문제, 의견이 있으신가요? support@speechdisplay.com로 메일을 보내 주세요. 기꺼이 도와드리겠습니다.