개요
Google은 Gemini macOS 앱에 현재 작업 흐름을 벗어나지 않고 음성으로 텍스트를 입력·편집·요약할 수 있는 기능을 추가했다. Fn 키를 길게 누르면 어느 데스크톱 창에서든 말할 수 있고, 기본 모드에서는 지능형 받아쓰기가 정리된 텍스트를 커서 위치에 삽입한다.
핵심 기능
- 지능형 받아쓰기: “음”, “어” 같은 필러를 제거하고 말하다가 수정한 내용을 반영한다.
- 화면 맥락 기반 작업: 설정에서 Gemini reasoning을 활성화하면 선택한 로컬 파일·이미지·문서의 내용을 읽고 요약할 수 있다.
- 음성 편집: 선택한 텍스트의 어조를 바꾸거나 메모를 임원용 요약으로 재작성한다.
- 이미지 생성·편집: 화면의 일러스트를 참조해 다크 모드 버전 등을 요청할 수 있다.
의의
이 기능은 별도의 챗봇 창으로 자료를 복사하는 방식보다, 현재 사용 중인 앱의 커서와 화면 맥락을 중심으로 음성 인터페이스를 제공한다는 점이 핵심이다. 받아쓰기와 추론 기반 작업을 하나의 Fn 키 진입점으로 연결해 문서 작성·요약·아이디어 구상 흐름의 마찰을 줄이는 방향이다.
출시 범위와 주의점
2026년 7월 29일 기준 영어로 Gemini macOS 앱 사용자에게 전 세계 출시 중이며, 추가 언어는 추후 지원 예정이다. 화면 맥락을 사용하는 reasoning 모드는 선택적으로 활성화해야 한다. 기사 내 음성 재생은 Google AI가 생성한 실험적 콘텐츠로 표시되어 있다.
관련 노트
출처 및 검증
- 원문: https://blog.google/innovation-and-ai/products/gemini-app/speak-naturally-gemini-app-mac-os/
- 저자: Michael Friedman, Alvin Zhou
- 게시일: 2026-07-29
- 원문 캡처 SHA-256:
435880906e1d5ced0d02c98d482910dda1aa090e37e26a95d1ee72914dcc6a8c