TOPIC

音声AI

音声認識、音声合成、リアルタイム音声対話を、製品や業務へ実装するための技術情報をまとめています。

関連するサービス

課題、データ、評価方法に合わせて実装の進め方をご提案します。

音声AI受託開発

記事一覧

CONVERGENCE LAB.
音声AILLMリアルタイム音声対話

S2S LLMを比較する:Gemini Live、GPT-Realtime、Qwen Omni Realtime、Grok Voice Agent API

木村 優志
顧客の「まだ名前のない」AI製品アイデアを、形にするために
AI応用プロダクト開発音声AI

顧客の「まだ名前のない」AI製品アイデアを、形にするために

木村 優志
商用利用できる日本語音声合成モデル・API 11選:選び方とライセンス確認の要点
音声生成AI

商用利用できる日本語音声合成モデル・API 11選:選び方とライセンス確認の要点

木村 優志
プラグアブルFull-duplex音声対話を実現する「データの壁」をどう乗り越えるか
音声LLM

プラグアブルFull-duplex音声対話を実現する「データの壁」をどう乗り越えるか

木村 優志
LLM-jp-Moshi-v1の衝撃:音声対話の「自然さ」の先にある、ビジネス実装の最適解とは?
音声LLM

LLM-jp-Moshi-v1の衝撃:音声対話の「自然さ」の先にある、ビジネス実装の最適解とは?

木村 優志
Audio LLMの新時代:Qwen 3.5とOmniモデルが書き換える「音とAI」の境界線(2026年版)
音声AI

Audio LLMの新時代:Qwen 3.5とOmniモデルが書き換える「音とAI」の境界線(2026年版)

木村優志
「待たせない」から「即解決」へ——Full-duplexとRAG・実務連携が変えるAI音声対話の最適解
AI音声

「待たせない」から「即解決」へ——Full-duplexとRAG・実務連携が変えるAI音声対話の最適解

木村優志
フルデュプレックス音声対話の「実装」をどう選ぶか? — 700万時間の壁と、Convergence Lab.が提供する現実解
音声AI

フルデュプレックス音声対話の「実装」をどう選ぶか? — 700万時間の壁と、Convergence Lab.が提供する現実解

木村 優志
AIと「被せて」話す時代へ。Full Duplex(全二重)音声対話最前線 Moshi, PersonaPlex, FireRedChat, FlexDuoに見る、リアルタイム対話の進化
音声AI

AIと「被せて」話す時代へ。Full Duplex(全二重)音声対話最前線 Moshi, PersonaPlex, FireRedChat, FlexDuoに見る、リアルタイム対話の進化

木村 優志
音声認識AIモデル ZipFormer
音声

音声認識AIモデル ZipFormer

木村 優志
製造現場で使える軽量デバイスでも動作する異常音検知システム
AI音声

製造現場で使える軽量デバイスでも動作する異常音検知システム

木村 優志
水道管の破裂をAI で検知する
AI音声

水道管の破裂をAI で検知する

木村 優志
音声解析 AI の開発事例
音声AI

音声解析 AI の開発事例

木村 優志

すべての記事を見る →

AI CONSULTING & DEVELOPMENT

AI活用の構想から実装・運用まで、ご相談ください

課題の整理、データの確認、PoC、本番導入まで、状況に合わせてご支援します。