사십 년 동안 우리는 기호로 설명해 왔습니다. 말로 하세요.

Windows를 위한 음성 입력, 에이전트, 자동완성. 어떤 프로그램 위에서도.

기존 사용 환경 그대로

CursorClaudeChatGPTCopilotVS CodeJetBrainsZedSlackTelegramWhatsAppGmailNotionObsidianDocsFigmaLinearChromeCursorClaudeChatGPTCopilotVS CodeJetBrainsZedSlackTelegramWhatsAppGmailNotionObsidianDocsFigmaLinearChrome

속도

말하기는 타이핑보다 빠릅니다. 눈에 띄게 빠르죠.

대화 속도는 분당 약 150단어입니다. 타이핑은 평균 40단어이며, 오타 수정 시간은 포함되지 않습니다.

음성 입력150 wpm
키보드 입력40 wpm

왼쪽 시계는 음성 인식, 포맷팅, 삽입까지의 모든 과정을 보여줍니다. 첫 화면과 동일한 3단계입니다. 말하는 동안에는 초안이 표시되지 않습니다. 오른쪽은 분당 40단어 속도로 타이핑하며 오타가 하나 발생한 경우입니다.

두 번째 단계

누구나 받아쓰기는 할 수 있습니다. 차이는 그 이후에 발생합니다.

일반적인 받아쓰기는 텍스트를 직접 수정해야 하는 단어의 흐름만 제공합니다. Midri Voice는 사용자가 스스로 수정한 부분, 생각이 끝난 지점, 텍스트에 포함되지 말아야 할 부분을 파악합니다.

들리는 그대로

음, 그러니까 제가 보고서를 봤는데요, 어, 3분기가 아니라 4분기 매출에 관한 것이었습니다. .

“세 번째, 아니 네 번째”는 자기 수정입니다. 의도한 내용만 텍스트에 남습니다.

음성 대화

명령어가 아닌 대화

사용자가 말하는 동안 실시간으로 듣고 즉시 음성으로 답변합니다. 중간에 받아쓰기 과정이 없습니다. 대화 도중 말을 끊거나, 다시 질문하거나, 내용을 수정할 수 있습니다.

사용자Spotify 열고 차분한 음악 틀어줘

어시스턴트Spotify를 실행합니다

사용자30분 뒤에 전화하라고 알려줘

어시스턴트알겠습니다. 대화창이 열려 있는 동안 7시에 알려드릴게요.

문장 끝에서 첫 소리까지 1.4초

손발이 되어주는 비서

말하는 것이 곧 실행입니다

필요한 것을 말하면 최대 3명의 수행원이 동시에 작업을 시작합니다. 모든 권한은 개별적으로 승인하며, 기본적으로 화면 보기 권한만 활성화되어 있습니다.

MidriMidri Voice

어시스턴트 권한

어시스턴트가 이 컴퓨터에서 수행할 수 있는 작업

사용자의 컴퓨터와 파일입니다. 필요한 기능만 켜주세요. 권한은 언제든 취소할 수 있지만, 이미 수행된 작업은 되돌릴 수 없습니다.

질문 빈도권한은 허용 범위를 결정하며, 이 설정은 어시스턴트가 작업을 수행할 때 사용자에게 확인을 요청하는 빈도를 결정합니다.
항상 질문단독 작업 수행, 되돌릴 수 없는 작업 시 중지질문 안 함
화면 보기스크린샷 및 창 내용. 이 권한이 없으면 어시스턴트가 화면을 볼 수 없습니다.
프로그램 실행설치된 프로그램을 열고 전환합니다
파일 작업파일을 읽고, 생성하고, 수정하고, 이름을 변경합니다. 삭제 시 휴지통으로 이동하며 영구 삭제되지 않습니다
명령 실행PowerShell 명령을 실행합니다. 위험한 명령은 프로그램 내에서 차단되며 어떤 권한으로도 실행되지 않습니다
브라우저 사용페이지를 열고 읽고 클릭하세요. 사용자가 직접 로그인한 실행기 전용 브라우저에서 작동하며, 기존 탭은 볼 수 없습니다

당신의 것

생김새는 당신이 정합니다

네 가지 모양, 일곱 가지 색. 고르거나, 갈아입는 걸 지켜보세요.

모양이나 색을 눌러 보세요

그래도 타이핑할 때

문장의 절반은 이미 머릿속에 있었다

시작한 문장을 대신 끝냅니다. 우리 창이 아니라, 지금 실제로 쓰고 있는 그 창 위에서요. 마음에 들면 Tab, 아니면 계속 치세요. 말없이 사라집니다.

Slack
#
A
Ann10:12
내보내기 작업 수정 사항을 반영했습니다. 이제 더 빨라질 것입니다.
M
Max10:15
좋습니다. 야간 작업을 다시 실행해서 수치를 확인하겠습니다.
수정 반영하고 야간 빌드를 다시 돌렸어요, 내보내기가 11분이 아니라 4분 만에 끝났습니다.
1손을 멈추면
2뒷부분을 제안하고
3Tab이면 내 것

코드 및 프롬프트

편집기에 프롬프트를 받아쓰세요. 용어는 그대로 유지됩니다.

“Use state”는 useState가 되고, “task dashboard”는 TaskDashboard가 됩니다. 이름은 발음과 화면에 열려 있는 내용을 바탕으로 복원됩니다.

어시스턴트
~/프로젝트
어시스턴트준비되었습니다. 작업을 설명해 주세요.

Claude Sonnet

발음과 화면에 열려 있는 내용을 바탕으로 복원된 코드 이름입니다.

mainTypeScript7행, 22열
기존 사용 환경 그대로CursorClaudeChatGPTCopilotVS CodeJetBrainsZed

말하는 즉시 번역

사용자의 언어로 말하면 상대방의 언어로 입력됩니다.

번역은 별도의 단계가 아니라 동일한 키 입력 과정의 일부입니다. 25개 언어를 지원하며, 설정에서 대상 언어를 한 번만 선택하면 됩니다.

Slack
#team
D
Dana13:48
내보내기 작업 수정 사항을 반영했습니다. 이제 더 빨라질 것입니다.
I
Ivan13:55
좋습니다. 야간 작업을 다시 실행해서 수치를 확인하겠습니다.
M
Mark14:02
풀 리퀘스트를 다시 한번 확인해 주시겠어요?
EN안녕하세요! 수정 사항 감사합니다. 모든 내용을 수정해서 다시 보냈습니다.

삽입 위치: ES

메시지 #team

타인의 텍스트

텍스트를 선택하면 모국어로 읽어줍니다

텍스트를 선택하면 자동으로 툴바가 나타납니다. 번역 카드에는 질문 입력란이 있어 음성이나 텍스트로 텍스트의 내용이나 어조에 대해 물어볼 수 있습니다.

Telegram
J
James
최근 접속
오늘
스테이징 배포가 완료되었나요?
18:54
네, 한 시간 전에 배포되었습니다. 로그는 정상입니다.
18:57
좋습니다. 그런데 한 가지 확인 부탁드립니다.
19:03
마이그레이션 문제가 해결될 때까지 배포가 중단되었습니다. 프로덕션 환경을 망치는 것보다 늦게 출시하는 편이 낫습니다.
19:12
메시지

텍스트 채팅

소리 내어 말할 수 없을 때도 있습니다. 물어볼 수는 있습니다.

단축키를 누르면 작업 중인 화면 위에 바로 나타납니다. 음성 어시스턴트가 기억하는 내용을 공유하고 동일한 도구에 접근하며, 생각하는 즉시 답변을 제공합니다. 세 번째 줄이 작성되는 동안 첫 번째 줄을 바로 읽을 수 있습니다.

분기별 보고서.docx

작업 중 브라우저 탭이 열려 있지 않거나 전환할 대상이 없을 때,

메모리

단순한 사실의 나열이 아닌 연결망

일반적인 메모리는 단어 일치 방식으로 검색되는 파일 내의 텍스트 줄이지만, 여기서는 링크를 통해 메모리가 구성됩니다. 새로운 정보는 스스로 연관된 정보를 찾고, 어시스턴트는 기억을 불러올 때 링크를 따라가며 주변 정보까지 함께 가져옵니다.

MidriMidri Voice
대화메모리
메모리 검색
Max라고 불림TypeScript 작성화요일 스탠드업프로젝트 “Storefron…4분기 매출 보고서단답형 선호시간대 - 모스크바마이그레이션 관련 문의Slack 사용
9개 노드·이 컴퓨터에 저장됨모두 보기
150wpm

대화형 말하기 속도

1.4

마지막 단어부터 음성 답변까지

25언어

삽입 시 번역 언어

주요 기능

열 개의 창 대신 하나의 어시스턴트

음성 대화, 앱 및 파일 제어, 알림 설정, 개인 맞춤형 설정, 그리고 모든 것의 시작인 받아쓰기 기능까지 제공합니다.

어시스턴트

사용자가 말을 걸었을 때 수행하는 작업입니다.

10

텍스트가 아닌 음성으로 답변

사용자가 말하는 도중에도 음성을 인식하여 즉시 답변하며, 별도의 텍스트 변환 과정 없이 바로 음성으로 응답합니다. 첫 응답까지 약 1.5초가 소요됩니다.

“스포티파이 열어줘” - 즉시 실행

설치된 모든 앱을 인식하여 이름으로 실행합니다. 이미 실행 중인 앱을 요청하면 새 창을 여는 대신 해당 창을 활성화합니다.

별도의 브라우저 사용

어시스턴트는 자체 프로필이 포함된 별도의 Chromium 브라우저를 사용합니다. 웹 페이지 읽기, 클릭, 입력 등은 해당 브라우저 내에서만 수행됩니다. 필요한 사이트에 한 번만 로그인해 두시면 됩니다. 브라우저는 별도로 다운로드되며, 설치 파일 크기는 149MB, 설치 후 용량은 344MB입니다.

30가지 목소리 선택 가능

낮고 차분한 목소리부터 활기차고 빠른 목소리, 부드럽고 여유로운 목소리까지. 오브 메뉴나 설정에서 변경할 수 있습니다. 30개 중 2개는 무료 플랜에서도 사용 가능합니다.

사용자의 화면을 인식

화면을 공유하고 궁금한 점을 물어보세요. 오류 메시지 읽기, 단계별 안내, 낯선 창에 대한 설명 등을 제공합니다.

대화 중 음성으로 알림

“30분 뒤에 알려줘”라고 말하면 대화창이 열려 있는 동안 30분 뒤에 음성으로 알려줍니다. 알림창이 아닌 대화 도중 자연스러운 문장으로 전달됩니다.

받아쓰기

사용자의 음성이 텍스트로 변환되는 과정입니다.

9

인터넷 없이 작동

음성 인식은 컴퓨터 내부에서 처리됩니다. 인터넷 연결이 끊겨도 받아쓰기는 규칙에 따라 계속 작동하며, 음성 데이터는 외부로 전송되지 않습니다.

사용자 지정 이름 및 용어

GitHub, macOS, Kubernetes 등 45개의 주요 용어는 자동으로 인식됩니다. 그 외 용어는 제한 없이 목록으로 추가할 수 있으며, 발음을 기준으로 매칭됩니다.

화면을 통한 힌트 제공

활성 창의 이름이 현재 문구의 사전에 추가됩니다. “Slack”에 대해 이야기할 때 해당 단어가 정확하게 입력됩니다.

모든 키 또는 조합

Right Alt, Caps Lock, Ctrl+Shift 등 무엇이든 단일 키를 포함하여 설정할 수 있습니다. 무전기처럼 말하는 동안 누르고 계세요.

나만의 작성 규칙

“비즈니스 톤”, “느낌표 사용 안 함”, “짧은 문장” 등 규칙을 말로 작성하면 모든 문구에 적용됩니다.

아무것도 사라지지 않습니다

받아쓰기한 모든 내용은 손쉽게 다시 확인할 수 있으며 클릭 한 번으로 붙여넣을 수 있습니다. 모든 데이터는 컴퓨터에만 저장됩니다.

로컬 실행

사용하지 않을 때 프로그램이 기기 내에서 유지되는 방식입니다.

4

작은 상자가 아닌 9개의 섹션

받아쓰기, 텍스트 처리, 채팅, Live AI, 커넥터, 기록, 테마, 시스템, 구독 정보로 구성됩니다. 어시스턴트 권한과 작업 모델은 대화를 시작하는 “Live AI” 메뉴에서 관리합니다. 테마, 12가지 강조 색상, 창 재질, 패널 위치를 설정할 수 있습니다.

사용하지 않을 때는 얇은 바 형태

사용하지 않을 때는 화면 가장자리에 얇은 바 형태로 유지됩니다. 마우스를 올리면 마이크, 대화, 어시스턴트, 설정 메뉴가 펼쳐지고 다시 자동으로 숨겨집니다.

개인 API 키 사용 가능

결제 방식이 마음에 들지 않으시면 OpenAI, Anthropic, Google 등 제공업체의 개인 키를 입력하여 해당 모델을 사용할 수 있습니다. 키는 Windows 자격 증명 관리자에 저장되며 당사 서버로 전송되지 않습니다.

화면 옆에서 조용히 작동

패널은 작업 창의 포커스를 뺏거나 화면을 가리지 않으며 커서를 이동시키지 않습니다. 브라우저 사용 권한을 부여하여 브라우저를 직접 제어하는 경우에만 별도의 창이 열립니다.

설치

음성 데이터는 컴퓨터 외부로 유출되지 않습니다

인식은 로컬 모델에서 실행되므로 인터넷 연결이 필요 없으며 외부로 전송되는 데이터도 없습니다. 프로그램 사용을 위해 계정이 필요하며, 계정을 통해 스마트 처리, 번역, 음성 출력, 어시스턴트 등 서버 측 기능을 이용할 수 있습니다.

macOS

계획 중

아직 준비되지 않았습니다

Linux

계획 중

아직 준비되지 않았습니다

현재 비공개 베타 단계로, 공개 빌드가 아직 없습니다. 계정을 생성해 주시면 빌드 배포가 가능해지는 즉시 안내해 드리겠습니다. macOS 및 Linux 버전은 계획 중이나 아직 개발이 시작되지 않았습니다.

요금

당신의 컴퓨터가 계산하는 건 무료. 우리 서버가 계산하는 건 유료

인식은 당신의 기계에서 돌고 우리에게는 한 푼도 들지 않습니다. 값을 받는 건 우리 쪽에서 도는 것들 - 다듬기, 번역, 음성, 에이전트입니다.

연간 20% 저렴

Free

일단 써 보기

$0
시작하기
음성 입력
80k
자동완성
80k
에이전트
300k
기기
3
인원
1

Plus

하루 종일 씁니다

$5.99
선택
음성 입력
무제한
자동완성
무제한
에이전트
1000k
기기
3
인원
1

Pro

쓰고, 맡깁니다

$12.99
선택
음성 입력
무제한
자동완성
무제한
에이전트
무제한
기기
5
인원
1

Ultra

여럿이 씁니다

$39.99
선택
음성 입력
무제한
자동완성
무제한
에이전트
무제한
기기
10
인원
5

사용량은 청구와 함께 매달 1일에 초기화됩니다.

질문

다운로드 전 자주 묻는 질문

Midri Voice는 Windows용 음성 어시스턴트입니다. 키를 누른 채 말하면 입력 중이던 창에 텍스트가 즉시 완성되어 나타납니다. 또는 음성으로 대화하여 답변을 듣거나, 앱을 실행하고 파일을 정리할 수도 있습니다.

프리뷰 기간 동안은 무료입니다. 현재 사이트에서 결제가 이루어지지 않으며 카드 정보를 요구하지 않습니다.

네. Google 계정으로 한 번의 클릭만으로 로그인할 수 있으며, 별도의 비밀번호를 만들거나 기억할 필요가 없습니다. 계정은 유료 플랜 및 사용량 관리에 사용됩니다.

받아쓰기는 사용자의 기기에서 직접 처리되므로 오디오 데이터가 외부로 전송되지 않습니다. 반면 음성 대화는 서비스 서버를 거쳐야 답변을 생성할 수 있으므로 음성 데이터가 전송됩니다.

현재 Windows 10 및 Windows 11을 지원합니다. 다른 시스템도 지원 예정이며, 어시스턴트 자체는 Windows에 종속되지 않습니다.

텍스트 필드가 있는 모든 창에서 작동합니다. Cursor, VS Code, JetBrains, 터미널, Telegram, Slack, Gmail, Notion, 브라우저 등 어디든 가능합니다. 말하기 전에 클릭한 텍스트 필드를 기억하므로 창이 이동해도 텍스트가 정확히 입력됩니다.

내장 받아쓰기는 단순히 소리를 받아 적지만, Midri는 문맥을 이해합니다. 구두점 자동 삽입, 불필요한 추임새 제거, 코드 및 고유 명사 보존, 실시간 번역은 물론 이전 대화 내용까지 기억합니다.

지금 바로 체험해 보세요. 이 페이지를 다 읽기보다 빠릅니다.

음성 인식은 사용자 컴퓨터에서 직접 이루어집니다. 계정은 스마트 처리, 번역, 음성 대화, 어시스턴트 등 서버 측에서 처리되는 기능에 사용됩니다.

Windows 11 · 프리뷰 기간 무료