2026年8月19日 音声生成 音声認識 【 Breking News 】Cartesia、音声合成モデル「Sonic-3.6」をベータ公開 44言語対応でリーダーボード1位を獲得 音声 AI スタートアップの Cartesia は 2026 年 8 月 18 日、最新の音声合成モデル「Sonic-3… 続きを読む »
2026年8月1日 AIエージェント xAI / SpaceX xAI、音声AIモデル「Grok Voice Think Fast 2.0」を発表 米国の AI 開発企業 xAI は、2026 年 7 月 29 日に音声 AI モデル「Grok Voice Think… 続きを読む »
2026年7月13日 OpenAI 基盤モデル(LLM) OpenAI、次世代音声モデル「GPT-Live」を世界展開開始 OpenAI は 2026 年 7 月 8 日、新しい音声モデル「GPT-Live」の提供を、ChatGPT の iOS… 続きを読む »
2026年6月17日 音声生成 音声認識 Cartesia、音声合成「Sonic-3.5」と音声認識「Ink-2」を同時リリース 米スタンフォード大 AIラボからスピンアウトし、音声 AI を手がけるスタートアップの Cartesia は、テキスト読… 続きを読む »
2026年5月9日 OpenAI 音声生成 OpenAI の新しい音声モデル3種発表ー推論・翻訳・文字起こしをリアルタイムで OpenAI は 2026 年 5 月 7 日、音声対話に特化した API「 Realtime API 」向けに、3つの… 続きを読む »
2026年4月28日 xAI / SpaceX 音声生成 xAI、音声AIエージェント「Grok Voice Think Fast 1.0」を発表—企業向けに API 提供開始 イーロン・マスク氏が創業した xAI は 2026 年 4 月 23 日、新しい音声 AI エージェント「Grok Vo… 続きを読む »
2026年4月18日 Google / DeepMind 音声生成 Google、テキスト読み上げモデル「Gemini 3.1 Flash TTS」をリリース Google DeepMind は 2026 年 4 月 15 日、新しいテキスト読み上げモデル「 Gemini 3.1… 続きを読む »
2026年4月10日 Google / DeepMind 基盤モデル(LLM) Google の新音声 AI モデル「 Gemini 3.1 Flash Live 」が正式発表——主な改善点と提供形態 Google は 2026 年 3 月 27 日、音声によるリアルタイム会話に特化した AI モデル「 Gemini 3… 続きを読む »
2026年4月10日 Mistral フランス Mistral、テキスト読み上げモデル「Voxtral TTS」を公開 フランスの AI 企業 Mistral は 2026 年 3 月 26 日、同社初となるテキスト読み上げモデル「Voxt… 続きを読む »
2025年12月15日 ElevenLabs Meta MetaがElevenLabsと提携、InstagramとHorizonで音声AIを本格導入へ 2025年 12 月、AI 音声合成技術のリーディングカンパニーである ElevenLabs は、ソーシャルメディア大手… 続きを読む »
2025年11月14日 ElevenLabs 音声生成 AI音声大手ElevenLabs、有名人音声マーケットプレイス「Iconic Voice」発表 AI 音声技術を手がける ElevenLabs は 11 月 11 日、初開催の ElevenLabs Summit で… 続きを読む »
2025年9月7日 Tencent 中国 Tencent が動画向け AI 効果音生成「 HunyuanVideo-Foley 」をオープンソース化 中国 IT 大手の Tencent は 2025 年 8 月 28 日、動画に自動でプロフェッショナル品質の効果音を生成… 続きを読む »