AIによる画像認識と音声認識のお仕事

AIによる画像認識と音声認識のお仕事

告知
IT・テクノロジー
先月より、AIによる画像認識と音声認識のお仕事を少し受けている。
たんに、APIに応答するだけなら、簡単だけど
いろんなニーズがあり、単にAPIに渡す以外のことが必要になることが
よくわかりました。

もっとも重要なのは、「精度」に対するニーズですね。
案件をうけつつ、いろいろテストを重ねて、どう精度を高めていくかという
ポイントや経験値が溜まってきました。
画像は、openaiも、Geminiも、Claudeも比較してみました。


音声に関しては、動画の音声のテキスト化、翻訳、トランスクリプト化などもいろいろ実験しました。
スポーツの実況中継の音声を題材にしてみました。
プロの翻訳家に負けないようなレベルで、AIやシステムだけでどう迫れるかも
実験してみました。かなりいいところまで行くことができました。

テキスト系だけでなく、このような画像認識や音声認識のAI利用もとてもおもしろいですね。

AIの画像認識ツールの作成のご用命は、こちらからお願いします。


音声の方は、出品していませんが、承ること可能です。

いろいろ質問やご相談だけでも、OKです。
そういう話を振っていただけるだけで、私も楽しいので。



サービス数40万件のスキルマーケット、あなたにぴったりのサービスを探す