音声/ボイスニュースまとめ | GameBusiness.jp

音声/ボイスに関するニュースまとめ一覧

音声/ボイス 最新ニュース

Read more
自分と妻の歌声をAIボーカルシンセ「DiffSinger」に進化させた。もうボイチェン不要。アルゴリズムベースの自動作曲ソフトとも統合(CloseBox) 画像
その他

自分と妻の歌声をAIボーカルシンセ「DiffSinger」に進化させた。もうボイチェン不要。アルゴリズムベースの自動作曲ソフトとも統合(CloseBox)

前回は、ゼロショットSVS(Singing Voice Synthesis、歌唱合成)の「SoulX-Singer」を妻の歌声で実験してみました。英語と中国語でしか使えないこのAIボーカルシンセに日本語をなんとか歌わせるところまではできました。では、次の段階へ。

自分専用の歌唱合成エディター&トレーナーをClaude Codeで開発。数十秒の歌唱データだけで歌ってくれるゼロショットボーカルシンセ「SoulX-Singer」の現在地(CloseBox) 画像
その他

自分専用の歌唱合成エディター&トレーナーをClaude Codeで開発。数十秒の歌唱データだけで歌ってくれるゼロショットボーカルシンセ「SoulX-Singer」の現在地(CloseBox)

最近は作家・ライター界隈で、自前のテキストエディターを開発する流れがありますが、筆者は自前のボーカルシンセエディターを作っています。どういうことかというと……。

音声合成ランキングで1位を獲得したAI「Qwen-Audio-3.0-TTS」をアリババが公開。日本語対応、音声クローンも可能(生成AIクローズアップ) 画像
その他

音声合成ランキングで1位を獲得したAI「Qwen-Audio-3.0-TTS」をアリババが公開。日本語対応、音声クローンも可能(生成AIクローズアップ)

今回は、Alibaba傘下の研究機関Tongyi Lab(Qwenの開発元)が発表した、テキスト音声合成(text-to-speech)モデル「Qwen-Audio-3.0-TTS」を取り上げます。

Stability AI、最大6分の音楽が生成できる「Stable Audio 3.0」発表。商用利用も可能 画像
企業動向

Stability AI、最大6分の音楽が生成できる「Stable Audio 3.0」発表。商用利用も可能

Stability AIは、音楽・音声生成AIモデルの新シリーズ「Stable Audio 3.0」を発表しました

逝去したナレーターのAI音声を使う許可を『Darkest Dungeon』開発元は得ていた…が、使わないと明言。「彼のパフォーマンスの価値を損なうようなことは絶対にしない」 画像
ゲーム開発

逝去したナレーターのAI音声を使う許可を『Darkest Dungeon』開発元は得ていた…が、使わないと明言。「彼のパフォーマンスの価値を損なうようなことは絶対にしない」

『Darkest Dungeon』の印象的なナレーターにAI音声は使わないと明言。

10年ぶりのボーカロイド対応「初音ミク V6」が正式リリース!LAM氏による新デザインも可愛い 画像
企業動向

10年ぶりのボーカロイド対応「初音ミク V6」が正式リリース!LAM氏による新デザインも可愛い

「初音ミク V6」2026年4月14日よりリリース!

声優・梶裕貴、新会社を設立―“そよぎフラクタル”を軸に音声AI事業と声優マネジメント事業を展開「新たな挑戦を、どうぞ温かくお見守りください」 画像
その他

声優・梶裕貴、新会社を設立―“そよぎフラクタル”を軸に音声AI事業と声優マネジメント事業を展開「新たな挑戦を、どうぞ温かくお見守りください」

『進撃の巨人』エレン・イェーガー役などで知られる声優・梶裕貴が、株式会社FRACTALを創業。音声AIプロジェクト【そよぎフラクタル】を軸とした音声AI事業、および声優マネジメント事業を展開する。

たった3秒の声サンプルで多言語ボイスクローンを生成できるオープンウェイト音声AI「Voxtral TTS」をMistral AIが開発(生成AIクローズアップ) 画像
その他

たった3秒の声サンプルで多言語ボイスクローンを生成できるオープンウェイト音声AI「Voxtral TTS」をMistral AIが開発(生成AIクローズアップ)

今回は、わずか3秒の参照音声から、自然で表現力豊かな音声を生成できる多言語対応の音声合成(TTS)モデルを提案した論文「Voxtral TTS」を取り上げます。このモデルはフランスのAI企業「Mistral AI」が開発しました。

“ほぼ人間”のAI音声を複数話者で一括生成。日本語対応オープンソースTTS「Fish Audio S2」、単語レベルの感情制御も可(生成AIクローズアップ) 画像
その他

“ほぼ人間”のAI音声を複数話者で一括生成。日本語対応オープンソースTTS「Fish Audio S2」、単語レベルの感情制御も可(生成AIクローズアップ)

1週間の気になる生成AI技術・研究をいくつかピックアップして解説する連載「生成AIウィークリー」から、特に興味深いAI技術や研究にスポットライトを当てる生成AIクローズアップ。今回は、人間の声と区別がつきにくいレベルに迫るリアルな音声を生成できるオープンソソース…

スイッチ2で音声入力ゲームが出るかも!?日立、直感的な操作を可能にする音声認識ソフトを開発会社向けに提供開始 画像
ゲーム開発

スイッチ2で音声入力ゲームが出るかも!?日立、直感的な操作を可能にする音声認識ソフトを開発会社向けに提供開始

組み込み機器向けの音声認識システムがスイッチ2に進出。

『Fallout 4』主人公ボイス追加が「これほど物議を醸すと思ってなかった」―開発者が10周年で振り返る 画像
文化

『Fallout 4』主人公ボイス追加が「これほど物議を醸すと思ってなかった」―開発者が10周年で振り返る

「2015年当時、ボイス付きの主人公は一般的でした」と語られています。

AIが音声を高品質テキスト化、朝日新聞社が「整文処理」特許を取得 画像
その他

AIが音声を高品質テキスト化、朝日新聞社が「整文処理」特許を取得

発話内容の忠実な再現と読みやすさの両立を実現する技術。

イレブンラボ、国際標準「C2PA」準拠。AI音声ディープフェイク対策と声優文化保護へ「二重の防壁」構築。梶裕貴も期待 画像
企業動向

イレブンラボ、国際標準「C2PA」準拠。AI音声ディープフェイク対策と声優文化保護へ「二重の防壁」構築。梶裕貴も期待

イレブンラボはC2PA準拠の技術でAI音声の出所証明と著作権保護を強化し、日本の声優文化を守る取り組みを進める。

声をデータとして扱う時代に──NTTが仕掛ける音声AIのトラスト基盤「VOICENCE」(石野純也) 画像
企業動向

声をデータとして扱う時代に──NTTが仕掛ける音声AIのトラスト基盤「VOICENCE」(石野純也)

NTT西日本は、音声AI事業の「VOICENCE(ボイセンス)」を発表しました。

『トゥームレイダー』のリマスターで生成AIボイスが勝手に使われている!声優がメーカー提訴、この問題が起きた理由とは 画像
その他

『トゥームレイダー』のリマスターで生成AIボイスが勝手に使われている!声優がメーカー提訴、この問題が起きた理由とは

他言語でもAI生成ボイスの疑いがあるようです。

読書バリアフリー推進へ、集英社が音声読書サイトを新設 画像
その他

読書バリアフリー推進へ、集英社が音声読書サイトを新設

読書バリアフリーとウェブアクセシビリティに対応した集英社初のサイト。

音声広告×リテールメディアの新ソリューションを共同開発、アドインテとオトナルが業務提携 画像
マネタイズ

音声広告×リテールメディアの新ソリューションを共同開発、アドインテとオトナルが業務提携

購買意欲の高いターゲット層へのより効果的なコミュニケーション実現を目指す。

ゲーム体験を阻害しない広告を実現、ARROVAとオトナルが新サービスを発表 画像
マネタイズ

ゲーム体験を阻害しない広告を実現、ARROVAとオトナルが新サービスを発表

ゲームプレイ中のユーザーは能動的に画面を注視し、音を聴取しているため、広告が記憶に残りやすくなります。

海外展開・マルチプラットフォーム対応を強力にサポート―『FREEDOM WARS Remastered』開発スタッフが語るReadSpeakerの強みと音声合成ソリューションの未来 画像
ゲーム開発

海外展開・マルチプラットフォーム対応を強力にサポート―『FREEDOM WARS Remastered』開発スタッフが語るReadSpeakerの強みと音声合成ソリューションの未来PR

開発を手がけるディンプスのコアスタッフに、音声合成ソリューション「ReadSpeaker」導入の経緯やReadSpeakerならではの魅力を聞きました。

生成AIによる合成音声を使用すると声優にも支払い―Speechlessが「ハイブリッドAIライセンス」を発表 画像
ゲーム開発

生成AIによる合成音声を使用すると声優にも支払い―Speechlessが「ハイブリッドAIライセンス」を発表

声優・俳優と合成音声生成AI双方の落としどころを探ったハイブリッドAIライセンスが登場しました。

  • 37件中 1 - 20 件を表示
  • 次へ