TTS(Text-to-Speech)
Text-to-Speech
文字情報を人工の声に変換して読み上げる技術であり、AIによって自然な音声で情報を耳から伝えることができる。
76用語
Text-to-Speech
文字情報を人工の声に変換して読み上げる技術であり、AIによって自然な音声で情報を耳から伝えることができる。
Video GAN
短いノイズベクトルから前景と背景を別々に生成して動きのある動画を作る敵対的生成モデル(GAN)
AI whisperer
AIに対して「最良の問いを囁き/対話を行い」、その出力を最適化する専門職・スキルセット
Video Diffusion

テキストや画像などの入力を元に、AIが自動で滑らかな映像や音声を生成する技術
Diffusion Model

ノイズを徐々に取り除きながらデータを作成する生成AI技術
Grounding
生成AIに信頼できる情報源に基づいて回答させる仕組み
Mixture of Experts
複数の異なる「専門家モデル(Expert)」を組み合わせ、それぞれが得意分野のタスクを担当することで、全体として高い性能と効率を実現するAIのアーキテクチャ
workslop
AI生成された内容が一見洗練されているものの、実質的な価値がない作業成果物のこと
Vertical AI
Vertical AI とは、特定の業界(たとえば医療、保険、製造、流通など)や業務ドメインに特化して設計・最適化された人工知能