AIが聴いて歌詞を書き出す
Jam Jamは音声ファイルに対して端末上で音声認識モデル(OpenAIのWhisperと同じ系統)を実行し、聞き取った内容を書き起こし、単語をビートに合わせてソングブック内の正しい位置に配置します。バックの楽器やミックスされたボーカルは、どんな書き起こしでも難しくなる要因ですが、この機能はクリーンなソロのボイスメモではなく、実際の曲のために作られています。
コード、キー、テンポを同時に
同じ取り込み処理で、最大168種類のコード(12のキーそれぞれで14種類のクオリティ)、さらに曲のキーとテンポも認識します。そのため歌詞は、ただの文字の羅列ではなく、すでに完全なコード譜とセットで手に入ります。
端末上で、または速さを求めるならサーバー上で
処理をどこで実行するか、毎回選べます。端末上で完全に完結させる(Androidではネイティブモデル、ブラウザではWeb Worker)か、より速い結果を求めてフランスにある当社サーバー上で処理するかです。サーバーに送られたファイルは解析が終わった瞬間に削除され、保存されることも、何かの学習に使われることもありません。
自分の録音の1つを取り込んでみましょう: