あとで試す
NVIDIAの1億パラメーター程度の軽量モデルか。議事録の「誰が喋ったか」問題は永遠の課題だし、ローカルで動くのは夢があるな
声優が声色を変えて喋っても同じ人だと見抜くのだろうか。
コレとJevとWeSpeakerとEchoハックを組み合わせるとWakeCall無しでAIスピーカーに頼めるな。
自作の録音文字起こしソフトに組み込んでみよう。
「モデル自体は文字起こしを行なわず、音声認識(ASR)と組み合わせる」
後で読みたい。AI議事録の「誰の発言か分からん」を解決。0.1B「Nemotron 3 Dia
うーむ
Teamsのcopaくんはその点優秀だと思う
AI議事録の「誰の発言か分からん」を解決。0.1B「Nemotron 3 Diarization」無償公開
あとで試す
NVIDIAの1億パラメーター程度の軽量モデルか。議事録の「誰が喋ったか」問題は永遠の課題だし、ローカルで動くのは夢があるな
声優が声色を変えて喋っても同じ人だと見抜くのだろうか。
コレとJevとWeSpeakerとEchoハックを組み合わせるとWakeCall無しでAIスピーカーに頼めるな。
自作の録音文字起こしソフトに組み込んでみよう。
「モデル自体は文字起こしを行なわず、音声認識(ASR)と組み合わせる」
後で読みたい。AI議事録の「誰の発言か分からん」を解決。0.1B「Nemotron 3 Dia
うーむ
Teamsのcopaくんはその点優秀だと思う