구글이 제미니 3.5 트랜스크라이브 음성-텍스트 변환 모델을 발표하며, "가장 정확하고" 화자의 의도를 이해할 수 있다고 주장합니다.
현지 시간 8월 26일, 구글은 최신 음성-텍스트 변환 모델인 Gemini 3.5 Transcribe를 출시했습니다. 이 모델은 인식 정확도를 높일 뿐만 아니라 화자의 의도를 이해하는 능력을 갖추고 있어, 자기 수정, 말버릇 삭제를 자동으로 인식하고 비정형적인 구어를 형식화된 텍스트로 변환할 수 있습니다. 구글은 이를 "가장 정확한" 모델이라고 칭하며, 이미 Android용 Gboard 및 Mac용 Gemini 앱에 도입되었고, Gemini API를 통해 개발자들에게 미리 보기를 제공하고 있습니다. 이번 출시는 Gemini 3.5 Live 및 Gemini 3.5 Live Experimental과 같은 날 출시되어 구글의 새로운 Gemini Audio 시리즈를 구성합니다. 분석가들은 음성 입력이 구글 제품에 빠르게 침투함에 따라, 음성 상호작용이 키보드 입력을 점차 대체하여 사용자와 AI 시스템을 연결하는 주요 방식이 될 것으로 보고 있습니다.
출처:华尔街见闻 · 원문 링크
면책 조항: 본 내용은 저자의 개인적인 견해일 뿐이며, 어떠한 투자·재무 조언도 구성하지 않습니다. 규정 위반 내용이 발견될 경우신고하기
24시간 인기 순위
-
1
BCUG 코인 분석: 블록체인 큐티 유니버스 거버넌스 토큰 현황 및 시장 유동성
-
2
CHP 코인 거래 가이드: 코인포커 토큰의 용도와 획득 방법 분석
-
3
AGGL 코인 가치 분석: 시장 활동성 극히 낮아 투자 전망 불확실
-
4
중국 본토 가상화폐 규제 현황 및 거래 위험 분석
-
5
OGN 거래 깊이 분석: 초보자가 반드시 알아야 할 10가지 핵심 포인트
-
6
가상화폐 현물 거래 플랫폼 및 소프트웨어: 주류 선택과 기능 분석
-
7
FEED 코인이란? 자선 지향 토큰 FEED 프로젝트 분석 및 시장 현황
-
8
비트코인 가격 지속 상승: 3가지 핵심 동인 분석
-
9
일본, 블록체인 기반 24/7 국채 및 주식 결제 시스템 탐색 계획, 2027년 초 개발 계획 확정 목표
-
10
BOLT 코인 다의적 분석: 탈중앙화 미디어 생태계와 밈코인 거래 가이드
오늘의 시세
추천 읽을거리











