生成AIAI_News

NaiveAIが309Bオープンモデル公開、音声ローカライズAPIも実用段階へ

2026年9月27日のAIニュースまとめ 生成AI
この記事は約3分で読めます。

対象日:2026年9月27日(日本時間)

9月27日は、長い文脈を扱うオープンウェイトモデルと、音声・動画を多言語化するAPIの動きが中心でした。モデルの規模だけでなく、推論速度、料金、対応言語、利用時の同意まで、実際に導入するための条件が具体化しています。

9月27日付で確認できた主要な公式発表は1件でした。加えて、前回の記事に未掲載で、今回の調査で新たに確認できたSarvamの9月26日付公式更新を2件掲載します。各ページの公開時刻は確認できないため、対象日と公式発表日を分けて記載しています。

1. NaiveAI、309BのオープンウェイトモデルNaive-N0.5-Flashを公開

NaiveAIは、コーディングとAI研究開発向けのMoEモデル「Naive-N0.5-Flash」を公開しました。総パラメータ309Bのうち15.5Bを動かし、ネイティブ100万トークンの文脈を扱います。重みと推論コードはMITライセンスで提供され、API料金は入力・出力・キャッシュ読み取りが100万トークン当たり0.10/0.40/0.01ドルです。速度や評価値は同社測定です。

2. Sarvam、話者の声を保つDubbing APIを提供開始

Sarvamは、音声・動画を複数言語へ変換するDubbing APIの提供を始めました。1回の非同期ジョブで12のインド言語を指定でき、話者の声を保った動画、音声、SRT字幕を書き出せます。Starterの標準料金は、変換元の長さと対象言語数に応じて1分40インドルピーです。標準プランの上限は1ファイル2GB・1時間です。

  • 発表元: Sarvam AI
  • 発表日: 2026年9月26日(今回の調査で新規確認)
  • 公式URL: Dubbing API

3. Sarvam、短い参照音声から多言語音声を生成するVoice Cloning APIを公開

Sarvamは、短い参照音声から保存済みの声を作り、その声で別言語の音声を生成できるVoice Cloning APIを公開しました。推奨する参照時間は10〜30秒、入力上限は50MB、1回の生成テキストは最大1,000文字です。料金は文字数単位で、利用には声の権利者の同意が必要です。短い生成では再文字起こしによる品質確認も行います。

  • 発表元: Sarvam AI
  • 発表日: 2026年9月26日(今回の調査で新規確認)
  • 公式URL: Voice Cloning API

今日のまとめ

今回の3件からは、AIの実用化が二つの方向で進んでいることが分かります。一つは、100万トークンの文脈とオープンな重みを備えたモデルを、研究や開発へ組み込みやすくする動きです。もう一つは、音声の翻訳や声の再現をAPIとして扱えるようにする動きです。特に音声クローンは、技術的に可能かどうかだけでなく、本人の同意と利用権限を確認することが欠かせません。

OpenAI Newsroom、Google AI Blog、Anthropic Newsroom、Meta AI Blog、Microsoft AI Blog、NVIDIA AI Blog、Hugging Face Blog、Mistral AI Newsでは、9月27日付と確認でき、前日分と重複しない主要な公式発表を採用しませんでした。日付を確認できない研究ページ、イベント告知、コミュニティ投稿、未発表情報は除外し、件数を増やすための過去記事は加えていません。

参照元一覧

タイトルとURLをコピーしました