Windows
Windows 11
Windows용 다운로드기존 사용 환경 그대로
속도
대화 속도는 분당 약 150단어입니다. 타이핑은 평균 40단어이며, 오타 수정 시간은 포함되지 않습니다.
왼쪽 시계는 음성 인식, 포맷팅, 삽입까지의 모든 과정을 보여줍니다. 첫 화면과 동일한 3단계입니다. 말하는 동안에는 초안이 표시되지 않습니다. 오른쪽은 분당 40단어 속도로 타이핑하며 오타가 하나 발생한 경우입니다.
두 번째 단계
일반적인 받아쓰기는 텍스트를 직접 수정해야 하는 단어의 흐름만 제공합니다. Midri Voice는 사용자가 스스로 수정한 부분, 생각이 끝난 지점, 텍스트에 포함되지 말아야 할 부분을 파악합니다.
음, 그러니까 제가 그 보고서를 봤는데요, 어, 3분기가 아니라 4분기 매출에 관한 것이었습니다. .
“세 번째, 아니 네 번째”는 자기 수정입니다. 의도한 내용만 텍스트에 남습니다.
음성 대화
사용자가 말하는 동안 실시간으로 듣고 즉시 음성으로 답변합니다. 중간에 받아쓰기 과정이 없습니다. 대화 도중 말을 끊거나, 다시 질문하거나, 내용을 수정할 수 있습니다.
사용자Spotify 열고 차분한 음악 틀어줘
어시스턴트Spotify를 실행합니다
사용자30분 뒤에 전화하라고 알려줘
어시스턴트알겠습니다. 대화창이 열려 있는 동안 7시에 알려드릴게요.
문장 끝에서 첫 소리까지 1.4초
손발이 되어주는 비서
필요한 것을 말하면 최대 3명의 수행원이 동시에 작업을 시작합니다. 모든 권한은 개별적으로 승인하며, 기본적으로 화면 보기 권한만 활성화되어 있습니다.
Midri Voice어시스턴트가 이 컴퓨터에서 수행할 수 있는 작업
사용자의 컴퓨터와 파일입니다. 필요한 기능만 켜주세요. 권한은 언제든 취소할 수 있지만, 이미 수행된 작업은 되돌릴 수 없습니다.
당신의 것
네 가지 모양, 일곱 가지 색. 고르거나, 갈아입는 걸 지켜보세요.
모양이나 색을 눌러 보세요
그래도 타이핑할 때
시작한 문장을 대신 끝냅니다. 우리 창이 아니라, 지금 실제로 쓰고 있는 그 창 위에서요. 마음에 들면 Tab, 아니면 계속 치세요. 말없이 사라집니다.
코드 및 프롬프트
“Use state”는 useState가 되고, “task dashboard”는 TaskDashboard가 됩니다. 이름은 발음과 화면에 열려 있는 내용을 바탕으로 복원됩니다.
프로젝트
발음과 화면에 열려 있는 내용을 바탕으로 복원된 코드 이름입니다.
말하는 즉시 번역
번역은 별도의 단계가 아니라 동일한 키 입력 과정의 일부입니다. 25개 언어를 지원하며, 설정에서 대상 언어를 한 번만 선택하면 됩니다.
삽입 위치: ES
타인의 텍스트
텍스트를 선택하면 자동으로 툴바가 나타납니다. 번역 카드에는 질문 입력란이 있어 음성이나 텍스트로 텍스트의 내용이나 어조에 대해 물어볼 수 있습니다.
텍스트 채팅
단축키를 누르면 작업 중인 화면 위에 바로 나타납니다. 음성 어시스턴트가 기억하는 내용을 공유하고 동일한 도구에 접근하며, 생각하는 즉시 답변을 제공합니다. 세 번째 줄이 작성되는 동안 첫 번째 줄을 바로 읽을 수 있습니다.
작업 중 브라우저 탭이 열려 있지 않거나 전환할 대상이 없을 때,
메모리
일반적인 메모리는 단어 일치 방식으로 검색되는 파일 내의 텍스트 줄이지만, 여기서는 링크를 통해 메모리가 구성됩니다. 새로운 정보는 스스로 연관된 정보를 찾고, 어시스턴트는 기억을 불러올 때 링크를 따라가며 주변 정보까지 함께 가져옵니다.
Midri Voice대화형 말하기 속도
마지막 단어부터 음성 답변까지
삽입 시 번역 언어
주요 기능
음성 대화, 앱 및 파일 제어, 알림 설정, 개인 맞춤형 설정, 그리고 모든 것의 시작인 받아쓰기 기능까지 제공합니다.
사용자가 말을 걸었을 때 수행하는 작업입니다.
10사용자가 말하는 도중에도 음성을 인식하여 즉시 답변하며, 별도의 텍스트 변환 과정 없이 바로 음성으로 응답합니다. 첫 응답까지 약 1.5초가 소요됩니다.
설치된 모든 앱을 인식하여 이름으로 실행합니다. 이미 실행 중인 앱을 요청하면 새 창을 여는 대신 해당 창을 활성화합니다.
어시스턴트는 자체 프로필이 포함된 별도의 Chromium 브라우저를 사용합니다. 웹 페이지 읽기, 클릭, 입력 등은 해당 브라우저 내에서만 수행됩니다. 필요한 사이트에 한 번만 로그인해 두시면 됩니다. 브라우저는 별도로 다운로드되며, 설치 파일 크기는 149MB, 설치 후 용량은 344MB입니다.
낮고 차분한 목소리부터 활기차고 빠른 목소리, 부드럽고 여유로운 목소리까지. 오브 메뉴나 설정에서 변경할 수 있습니다. 30개 중 2개는 무료 플랜에서도 사용 가능합니다.
화면을 공유하고 궁금한 점을 물어보세요. 오류 메시지 읽기, 단계별 안내, 낯선 창에 대한 설명 등을 제공합니다.
“30분 뒤에 알려줘”라고 말하면 대화창이 열려 있는 동안 30분 뒤에 음성으로 알려줍니다. 알림창이 아닌 대화 도중 자연스러운 문장으로 전달됩니다.
사용자의 음성이 텍스트로 변환되는 과정입니다.
9음성 인식은 컴퓨터 내부에서 처리됩니다. 인터넷 연결이 끊겨도 받아쓰기는 규칙에 따라 계속 작동하며, 음성 데이터는 외부로 전송되지 않습니다.
GitHub, macOS, Kubernetes 등 45개의 주요 용어는 자동으로 인식됩니다. 그 외 용어는 제한 없이 목록으로 추가할 수 있으며, 발음을 기준으로 매칭됩니다.
활성 창의 이름이 현재 문구의 사전에 추가됩니다. “Slack”에 대해 이야기할 때 해당 단어가 정확하게 입력됩니다.
Right Alt, Caps Lock, Ctrl+Shift 등 무엇이든 단일 키를 포함하여 설정할 수 있습니다. 무전기처럼 말하는 동안 누르고 계세요.
“비즈니스 톤”, “느낌표 사용 안 함”, “짧은 문장” 등 규칙을 말로 작성하면 모든 문구에 적용됩니다.
받아쓰기한 모든 내용은 손쉽게 다시 확인할 수 있으며 클릭 한 번으로 붙여넣을 수 있습니다. 모든 데이터는 컴퓨터에만 저장됩니다.
사용하지 않을 때 프로그램이 기기 내에서 유지되는 방식입니다.
4받아쓰기, 텍스트 처리, 채팅, Live AI, 커넥터, 기록, 테마, 시스템, 구독 정보로 구성됩니다. 어시스턴트 권한과 작업 모델은 대화를 시작하는 “Live AI” 메뉴에서 관리합니다. 테마, 12가지 강조 색상, 창 재질, 패널 위치를 설정할 수 있습니다.
사용하지 않을 때는 화면 가장자리에 얇은 바 형태로 유지됩니다. 마우스를 올리면 마이크, 대화, 어시스턴트, 설정 메뉴가 펼쳐지고 다시 자동으로 숨겨집니다.
결제 방식이 마음에 들지 않으시면 OpenAI, Anthropic, Google 등 제공업체의 개인 키를 입력하여 해당 모델을 사용할 수 있습니다. 키는 Windows 자격 증명 관리자에 저장되며 당사 서버로 전송되지 않습니다.
패널은 작업 창의 포커스를 뺏거나 화면을 가리지 않으며 커서를 이동시키지 않습니다. 브라우저 사용 권한을 부여하여 브라우저를 직접 제어하는 경우에만 별도의 창이 열립니다.
설치
인식은 로컬 모델에서 실행되므로 인터넷 연결이 필요 없으며 외부로 전송되는 데이터도 없습니다. 프로그램 사용을 위해 계정이 필요하며, 계정을 통해 스마트 처리, 번역, 음성 출력, 어시스턴트 등 서버 측 기능을 이용할 수 있습니다.
현재 비공개 베타 단계로, 공개 빌드가 아직 없습니다. 계정을 생성해 주시면 빌드 배포가 가능해지는 즉시 안내해 드리겠습니다. macOS 및 Linux 버전은 계획 중이나 아직 개발이 시작되지 않았습니다.
요금
인식은 당신의 기계에서 돌고 우리에게는 한 푼도 들지 않습니다. 값을 받는 건 우리 쪽에서 도는 것들 - 다듬기, 번역, 음성, 에이전트입니다.
사용량은 청구와 함께 매달 1일에 초기화됩니다.
질문
Midri Voice는 Windows용 음성 어시스턴트입니다. 키를 누른 채 말하면 입력 중이던 창에 텍스트가 즉시 완성되어 나타납니다. 또는 음성으로 대화하여 답변을 듣거나, 앱을 실행하고 파일을 정리할 수도 있습니다.
프리뷰 기간 동안은 무료입니다. 현재 사이트에서 결제가 이루어지지 않으며 카드 정보를 요구하지 않습니다.
네. Google 계정으로 한 번의 클릭만으로 로그인할 수 있으며, 별도의 비밀번호를 만들거나 기억할 필요가 없습니다. 계정은 유료 플랜 및 사용량 관리에 사용됩니다.
받아쓰기는 사용자의 기기에서 직접 처리되므로 오디오 데이터가 외부로 전송되지 않습니다. 반면 음성 대화는 서비스 서버를 거쳐야 답변을 생성할 수 있으므로 음성 데이터가 전송됩니다.
현재 Windows 10 및 Windows 11을 지원합니다. 다른 시스템도 지원 예정이며, 어시스턴트 자체는 Windows에 종속되지 않습니다.
텍스트 필드가 있는 모든 창에서 작동합니다. Cursor, VS Code, JetBrains, 터미널, Telegram, Slack, Gmail, Notion, 브라우저 등 어디든 가능합니다. 말하기 전에 클릭한 텍스트 필드를 기억하므로 창이 이동해도 텍스트가 정확히 입력됩니다.
내장 받아쓰기는 단순히 소리를 받아 적지만, Midri는 문맥을 이해합니다. 구두점 자동 삽입, 불필요한 추임새 제거, 코드 및 고유 명사 보존, 실시간 번역은 물론 이전 대화 내용까지 기억합니다.
음성 인식은 사용자 컴퓨터에서 직접 이루어집니다. 계정은 스마트 처리, 번역, 음성 대화, 어시스턴트 등 서버 측에서 처리되는 기능에 사용됩니다.
Windows 11 · 프리뷰 기간 무료