OpenAI、 Codex CLI v0.155.0 を 公開
OpenAI が Codex CLI の v0.155.0 を公開しました。 /experimental で音声会話と文字起こしを試せます。 対応 Mac では MCP 要求に Touch ID 認証を使えます。
OpenAI が Codex CLI の v0.155.0 を公開しました。 /experimental で音声会話と文字起こしを試せます。 対応 Mac では MCP 要求に Touch ID 認証を使えます。
Kotoba Technologies の佐々木悠太氏が音声 AI を登壇解説します。 イベントは Agora.io と AWS が 9月17日に東京で共催します。
LINE ヤフーが iOSDC Japan 2026 に 7 名登壇します。 同社はゴールドスポンサーを務めます。 登壇者は Foundation Models や Swift など 7 テーマを発表します。
Google が音声認識モデル Gemini 3.5 Transcribe を公開しました。詳しくは出典へ。
Anthropic が Claude Code の遠隔操作に対応しました。 スマホから新規セッションを開始できます。 接続が切れても自動で復旧します。
Mistral が HUMAIN とサウジアラビアの主権 AI で提携しました。 サイバーセキュリティと音声が初期の重点分野です。 アラビア語に強いフロンティアモデルも開発予定です。
ChatGPT の iOS 版に Codex Remote の起動設定が追加されました。 標準 MCP フォームとメッセージ承認の編集に対応しました。 音声は既存のタスク作成画面から使えます。
Kotoba の Koto が Agentforce Voice の日本語会話を支えます。詳しくは出典へ。
LINE の LIFF でグループビデオ通話を構築できます。 ウェブアプリとアプリサーバーの 2 つを用意します。 LINE Planet SDK で通話機能を実装します。
Hugging Face が音声 AI 評価の Real World VoiceEQ を公開しました。詳しくは出典へ。
CyberAgent AI Lab の 4 本の論文が INTERSPEECH 2026 に採択されました。 音声合成の転移学習では、元モデルの発音知識は寄与しません。 日本語の書記素音素変換では、最適な LLM が 0.52% 未満を達成しました。
BAIR が 2026年の博士課程修了生を紹介しました。 修了生の研究はロボティクスから AI 安全性まで多岐にわたります。
Kotoba がリアルタイム音声通訳のデモを披露しました。 東アジア言語向けの Koto 基盤モデルを開発しています。 Kindred Ventures などの出資を受けています。
Kotoba が jig.jp と提携し SABERA に同時通訳を提供します。 Kotoba のアプリと SABERA アプリを連携します。 装着者の視界に相手の言葉をリアルタイム表示します。
Kotoba がシードで 1,000 万ドルを調達しました。 累計調達額は 2,300 万ドルです。 音声モデル Koto の API と Python SDK を公開しました。
Gemini の音声生成モデルがストリーミングに対応しました。 gemini-3.1-flash-tts-preview で streamGenerateContent が使えます。 Interactions API では stream: true で利用できます。
DeepMind が音声モデル Gemini 3.5 Live Translate を発表しました。詳しくは出典へ。
Kotoba Technologies が音声 API と SDK のα版を公開しました。詳しくは出典へ。
OpenAI が音声 API に GPT Realtime 2 を追加しました。 Thinking Machines は低遅延の対話システムを予告しました。 Anthropic は Claude for Legal を公開しました。
OpenAI が Codex アプリを更新しました。 音声入力の整形と辞書設定を追加しました。 画像表示にズームとダウンロードを追加しました。
Kotoba Technologies が SusHi Tech Tokyo 2026 に協賛します。 会場で同時通訳アプリ Kotoba を無料提供します。 QR コードから入手しスマホで翻訳を閲覧できます。
Kotoba が SoftBank の Dare Demo AI に参加しました。 日韓の同時通訳モデルを正式公開しました。 日韓の平均遅延は約 1〜2秒です。
Kotoba Technologies がテレ東の番組に出演しました。 リアルタイム音声 AI と同時通訳技術を紹介します。 放送は 4月18日午前 11時からです。
DeepMind が音声モデル Gemini 3.1 Flash TTS を公開しました。詳しくは出典へ。
Google が Gemini 3.1 Flash TTS Preview を公開しました。詳しくは出典へ。