2025年9月7日 OpenAI 音声生成 OpenAI、Realtime APIを正式公開:音声対話モデル「gpt-realtime」 OpenAI は、ベータ版で提供されていた Realtime API を正式に一般公開し、新たな音声対話モデル「 gpt… 続きを読む »
2025年9月6日 Microsoft 基盤モデル(LLM) Microsoft が独自 AI モデル「MAI-Voice-1」と「MAI-1-preview」を発表 Microsoft は 2025 年 8 月 28 日、独自開発 AI モデル「 MAI-Voice-1 」と「 MAI… 続きを読む »
2025年8月27日 Microsoft 音声生成 Microsoft 、最大 90 分の長時間音声生成が可能な「 VibeVoice 」をオープンソースで公開 Microsoft は、長文オーディオや複数話者の会話音声を最大 90 分間生成できるオープンソースの「Text-to-… 続きを読む »
2025年8月9日 MiniMax 中国 中 MiniMax が 40 言語対応の音声 AI 「 Speech 2.5 」をリリース 中国の AI スタートアップ MiniMax は 2025 年 8 月 7 日、新世代の音声 AI 「 Speech 2… 続きを読む »
2025年7月24日 音声生成 Hume AI の「 EVI 3 」、 30 秒で声の個性まで再現する Speech-to-Speech モデルをリリース Hume AI が 2025 年 7 月 17 日、次世代の Speech-to-Speech モデル「 EVI 3 (… 続きを読む »
2025年6月11日 ElevenLabs 音声生成 ElevenLabs が表現力豊かなテキスト読み上げモデル「 Eleven v3 」を発表 AI 音声合成スタートアップの ElevenLabs は、新しいテキスト読み上げ( TTS )モデル「 Eleven v… 続きを読む »
2025年4月24日 韓国 音声生成 韓国の2人の大学生が開発した革新的TTS「Dia」、ElevenLabsを超える性能をオープンソースで公開 韓国のスタートアップ Nari Labs が 2025 年 4 月、画期的なオープンソースの音声合成(Text-to-S… 続きを読む »
2025年4月16日 Google / DeepMind 音声生成 Google が発表した DolphinGemma、イルカとの対話を目指す Google が 2025 年 4 月 14 日に発表した「DolphinGemma」は、イルカの音声通信を解析し、生成… 続きを読む »
2025年4月10日 Amazon 音声生成 Amazon、AI 音声モデル「 Nova Sonic 」と動画生成モデル「 Nova Reels 1.1 」を発表 Amazon は、新たな AI 音声モデル「Nova Sonic」と、動画生成モデル「Nova Reels 1.1」を発… 続きを読む »
2025年4月3日 中国 音声生成 MiniMax が「 Speech-02 」をリリース、テキストからリアルな音声生成 2021年に創業した中国・上海に本拠を置く AI スタートアップの MiniMax が「 Speech-02 」をリリー… 続きを読む »
2025年3月21日 OpenAI 音声生成 OpenAI 、次世代の音声 AI モデルをリリース ー 音声認識と合成が大幅進化 OpenAI は 2025 年 3 月 20 日、次世代の音声モデルを API ベースでリリースしました。この新モデルは… 続きを読む »
2025年3月18日 AIエージェント その他 Vogent AI、自己学習型の音声エージェントで自己改善 ー 人間の評価は不要 Vogent AI が3月11日に発表した「 Self-Learning Voice Agents (自己学習型音声エー… 続きを読む »