2026年10月3日 Microsoft 音声生成 Microsoft AI、音声文字起こし・読み上げモデル3種を同時リリース Microsoft AI は 2026 年 10 月 1 日、音声関連の新モデルを 3 つ同時に公開しました。リアルタイ… 続きを読む »
2026年9月29日 AIエージェント OpenAI ChatGPT Voice、音声でメールやカレンダーを操作できるプラグイン連携機能を追加 OpenAI は 2026 年 9 月 23 日、ChatGPT Voice の大幅なアップデートを発表しました。スマー… 続きを読む »
2026年9月18日 Google / DeepMind カスタマーサポート Google、音声 AI モデル「Gemini 3.8 Live」を発表——リアルタイム推論と 97 言語対応が特徴 Google は 2026 年 9 月 15 日、新しい音声 AI モデル「Gemini 3.8 Live」と「Gemi… 続きを読む »
2026年9月5日 Microsoft 音声認識 Microsoft、音声認識モデル「MAI-Transcribe-2」を公開 60言語対応で価格を72%引き下げ Microsoft AI は 2026 年 9 月 3 日、新しい音声認識モデル「MAI-Transcribe-2」を公… 続きを読む »
2026年9月5日 Meta 音声認識 Meta の音声認識 AI 「 Muse Voice Transcribe 」、 20 名以上の話者をリアルタイムで識別 Meta の AI 研究部門 Meta Superintelligence Labs は 2026 年 9 月 1 日、… 続きを読む »
2026年8月19日 音声生成 音声認識 【 Breking News 】Cartesia、音声合成モデル「Sonic-3.6」をベータ公開 44言語対応でリーダーボード1位を獲得 音声 AI スタートアップの Cartesia は 2026 年 8 月 18 日、最新の音声合成モデル「Sonic-3… 続きを読む »
2026年8月1日 AIエージェント xAI / SpaceX xAI、音声AIモデル「Grok Voice Think Fast 2.0」を発表 米国の AI 開発企業 xAI は、2026 年 7 月 29 日に音声 AI モデル「Grok Voice Think… 続きを読む »
2026年7月13日 OpenAI 基盤モデル(LLM) OpenAI、次世代音声モデル「GPT-Live」を世界展開開始 OpenAI は 2026 年 7 月 8 日、新しい音声モデル「GPT-Live」の提供を、ChatGPT の iOS… 続きを読む »
2026年6月17日 音声生成 音声認識 Cartesia、音声合成「Sonic-3.5」と音声認識「Ink-2」を同時リリース 米スタンフォード大 AIラボからスピンアウトし、音声 AI を手がけるスタートアップの Cartesia は、テキスト読… 続きを読む »
2026年5月9日 OpenAI 音声生成 OpenAI の新しい音声モデル3種発表ー推論・翻訳・文字起こしをリアルタイムで OpenAI は 2026 年 5 月 7 日、音声対話に特化した API「 Realtime API 」向けに、3つの… 続きを読む »
2026年4月28日 xAI / SpaceX 音声生成 xAI、音声AIエージェント「Grok Voice Think Fast 1.0」を発表—企業向けに API 提供開始 イーロン・マスク氏が創業した xAI は 2026 年 4 月 23 日、新しい音声 AI エージェント「Grok Vo… 続きを読む »
2026年4月12日 Google / DeepMind 音声認識 Google、オフライン対応の音声入力アプリ「AI Edge Eloquent」を iOS 向けに静かにリリース Google は 2026 年 4 月 6 日、プレスリリースも発表イベントもなく、音声入力アプリ「 Google AI… 続きを読む »