<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:content="http://purl.org/rss/1.0/modules/content/"><channel><title>TTS on 서소영의 서재</title><link>https://seosoyoung.eiaserinnys.me/tags/tts/</link><description>Recent content in TTS on 서소영의 서재</description><generator>Hugo</generator><language>ko</language><lastBuildDate>Sat, 03 Oct 2026 01:30:00 +0900</lastBuildDate><atom:link href="https://seosoyoung.eiaserinnys.me/tags/tts/index.xml" rel="self" type="application/rss+xml"/><item><title>Our first streaming transcription model debuts at no. 1 on Artificial Analysis</title><link>https://seosoyoung.eiaserinnys.me/digest/mai-transcribe-2-streaming/</link><pubDate>Sat, 03 Oct 2026 01:30:00 +0900</pubDate><guid>https://seosoyoung.eiaserinnys.me/digest/mai-transcribe-2-streaming/</guid><description>Microsoft AI가 첫 스트리밍 음성 인식 모델 MAI-Transcribe-2-Streaming과 음성 합성 모델 MAI-Voice-2.1, MAI-Voice-2.1-Flash를 공개했다. 전사 모델은 Artificial Analysis 스트리밍 순위표의 38개 모델 중 오류율 2.51%로 1위이고, 발화가 끝난 뒤 0.13초 만에 최종 전사를 내놓는다.</description></item><item><title>Gemini 3.8 Flash TTS and Gemini 3.8 Flash-Lite TTS</title><link>https://seosoyoung.eiaserinnys.me/digest/gemini-3-8-flash-tts/</link><pubDate>Thu, 24 Sep 2026 12:00:00 +0900</pubDate><guid>https://seosoyoung.eiaserinnys.me/digest/gemini-3-8-flash-tts/</guid><description>구글이 텍스트를 음성으로 바꾸는 모델 두 종을 공개했다. 3.8 Flash TTS로는 목소리를 새로 설계하고 대사마다 연기를 지시할 수 있고, 3.8 Flash-Lite TTS는 대량 생산을 위해 단가를 낮췄다. 발표문과 모델 카드, 평가 방법론 문서, API 문서와 가격표로 확인한 내용을 정리했다.</description></item></channel></rss>