2026年8月19日 音声生成 音声認識 【 Breking News 】Cartesia、音声合成モデル「Sonic-3.6」をベータ公開 44言語対応でリーダーボード1位を獲得 音声 AI スタートアップの Cartesia は 2026 年 8 月 18 日、最新の音声合成モデル「Sonic-3… 続きを読む »
2026年8月1日 AIエージェント xAI / SpaceX xAI、音声AIモデル「Grok Voice Think Fast 2.0」を発表 米国の AI 開発企業 xAI は、2026 年 7 月 29 日に音声 AI モデル「Grok Voice Think… 続きを読む »
2026年7月13日 OpenAI 基盤モデル(LLM) OpenAI、次世代音声モデル「GPT-Live」を世界展開開始 OpenAI は 2026 年 7 月 8 日、新しい音声モデル「GPT-Live」の提供を、ChatGPT の iOS… 続きを読む »
2026年6月17日 音声生成 音声認識 Cartesia、音声合成「Sonic-3.5」と音声認識「Ink-2」を同時リリース 米スタンフォード大 AIラボからスピンアウトし、音声 AI を手がけるスタートアップの Cartesia は、テキスト読… 続きを読む »
2026年5月9日 OpenAI 音声生成 OpenAI の新しい音声モデル3種発表ー推論・翻訳・文字起こしをリアルタイムで OpenAI は 2026 年 5 月 7 日、音声対話に特化した API「 Realtime API 」向けに、3つの… 続きを読む »
2026年4月28日 xAI / SpaceX 音声生成 xAI、音声AIエージェント「Grok Voice Think Fast 1.0」を発表—企業向けに API 提供開始 イーロン・マスク氏が創業した xAI は 2026 年 4 月 23 日、新しい音声 AI エージェント「Grok Vo… 続きを読む »
2026年4月12日 Google / DeepMind 音声認識 Google、オフライン対応の音声入力アプリ「AI Edge Eloquent」を iOS 向けに静かにリリース Google は 2026 年 4 月 6 日、プレスリリースも発表イベントもなく、音声入力アプリ「 Google AI… 続きを読む »
2026年4月10日 Google / DeepMind 基盤モデル(LLM) Google の新音声 AI モデル「 Gemini 3.1 Flash Live 」が正式発表——主な改善点と提供形態 Google は 2026 年 3 月 27 日、音声によるリアルタイム会話に特化した AI モデル「 Gemini 3… 続きを読む »
2025年12月21日 Meta 音声認識 Meta、直感的な操作で音声を分離するAIモデル「SAM Audio」を公開 2025年12月16日 Metaが、複雑な音声の中から特定の音だけを分離できる新しいAIモデル「SAM Audio」をリ… 続きを読む »
2025年12月15日 ElevenLabs Meta MetaがElevenLabsと提携、InstagramとHorizonで音声AIを本格導入へ 2025年 12 月、AI 音声合成技術のリーディングカンパニーである ElevenLabs は、ソーシャルメディア大手… 続きを読む »
2025年9月7日 OpenAI 音声生成 OpenAI、Realtime APIを正式公開:音声対話モデル「gpt-realtime」 OpenAI は、ベータ版で提供されていた Realtime API を正式に一般公開し、新たな音声対話モデル「 gpt… 続きを読む »
2025年7月24日 NVIDIA 音声認識 NVIDIA 「 Canary-Qwen-2.5B 」、 Hugging Face 音声認識リーダーボードでトップ獲得 NVIDIA が 2025 年 7 月 17 日に発表した新しい英語音声認識モデル「 Canary-Qwen-2.5B … 続きを読む »