개요

Google은 Gemini macOS 앱에 현재 작업 흐름을 벗어나지 않고 음성으로 텍스트를 입력·편집·요약할 수 있는 기능을 추가했다. Fn 키를 길게 누르면 어느 데스크톱 창에서든 말할 수 있고, 기본 모드에서는 지능형 받아쓰기가 정리된 텍스트를 커서 위치에 삽입한다.

핵심 기능

  • 지능형 받아쓰기: “음”, “어” 같은 필러를 제거하고 말하다가 수정한 내용을 반영한다.
  • 화면 맥락 기반 작업: 설정에서 Gemini reasoning을 활성화하면 선택한 로컬 파일·이미지·문서의 내용을 읽고 요약할 수 있다.
  • 음성 편집: 선택한 텍스트의 어조를 바꾸거나 메모를 임원용 요약으로 재작성한다.
  • 이미지 생성·편집: 화면의 일러스트를 참조해 다크 모드 버전 등을 요청할 수 있다.

의의

이 기능은 별도의 챗봇 창으로 자료를 복사하는 방식보다, 현재 사용 중인 앱의 커서와 화면 맥락을 중심으로 음성 인터페이스를 제공한다는 점이 핵심이다. 받아쓰기와 추론 기반 작업을 하나의 Fn 키 진입점으로 연결해 문서 작성·요약·아이디어 구상 흐름의 마찰을 줄이는 방향이다.

출시 범위와 주의점

2026년 7월 29일 기준 영어로 Gemini macOS 앱 사용자에게 전 세계 출시 중이며, 추가 언어는 추후 지원 예정이다. 화면 맥락을 사용하는 reasoning 모드는 선택적으로 활성화해야 한다. 기사 내 음성 재생은 Google AI가 생성한 실험적 콘텐츠로 표시되어 있다.

관련 노트

출처 및 검증