絞り込み条件を変更する
検索条件を絞り込む

すべてのブログから「#音声データ」タグの検索結果

10 件中 1 - 10 件表示
カバー画像

OpenAI Whisper

昼の情報番組をスマホで1分程録音して、その音声データの文字起こしをWhisperで行ったら、2時間半かかった。PCが「うーんうーん」って固まりまくり。古い記憶で、Windows95で重いソフトを動かした時の、あの反サクサク感を思い出させてくれた。勘弁してよ。とほほほ。。。で、出力された文字データが、下記「いないのはあらまん。不公平。全国的例。国民の訴えを返し出す。国民訴訟。裁判記録によると、来年7月の参院選に立候補しようとするも、非選挙権、えー、その立候補できる権利、満たしてない。強奪金300万円が用意できない。えー、立候補できず、と、いうことになった。立候補できなかった、木村佑美子は、選挙制度、合理的な理由なく差別だ。えー、憲法に違反している、と主張し、本人訴訟で、公別債に提出。本人訴訟、これ何なのか、この後聞きますが、まずその、非選挙権、えー、それから強奪金、えー、というのはこちらです。はい、仕組みこちらにまとめました。衆議院と参議院で、違っているんですけれども、非選挙権は、衆議院の場合、満25歳以上、そして参議院の場合、満30歳以上となっています。今回の場合、参議院ですから、あー、すいません、そうですね。30歳。参議院は30歳以上でないとダメだ。20代だった、君らより先。」首相襲撃事件を解説するコーナーでした。(ゴゴスマだったと思う。)精度はさっぱりやなぁ~。。。やっぱ、GPU入れんといかんなぁ~。
0
カバー画像

「文字起こし」と「議事録」は同じ?目的が違えば、残す内容も変わります

会議や打ち合わせを録音したあと、「とりあえず文字起こししておけば、議事録になるかな?」と思うことがあります。最近はAIを使えば、音声からかなり簡単に文字を起こせるようになりました。1時間の会議でも、以前のように最初からすべて手入力する必要はありません。とても便利になったと思います。ただ、「文字起こし」と「議事録」は、似ているようで少し違います。今回は、この違いについて整理してみます。文字起こしは「話したことを文字にする」文字起こしは、その名前の通り、音声として話された内容を文字にする作業です。例えば、Aさん「次回の研修ですが、10月に開催したいと思っています」Bさん「10月だと第2週がよいと思います」Aさん「では、10月10日前後で会場を確認してみます」といった会話があったとします。文字起こしでは、このように実際の発言を文字として残すことが中心になります。誰が何を話したのかを後から確認したい場合には、とても便利です。議事録は「必要な情報を整理して残す」一方、同じ会話を議事録にすると、少し形が変わります。例えば、議題:次回研修の日程・10月第2週を候補とする・10月10日前後で会場の空きを確認する・会場確認後に開催日を決定するといった形です。会話をすべて残しているわけではありません。その代わり、「何について話して、何が決まり、次に何をするのか」が分かりやすくなっています。これが、文字起こしと議事録の大きな違いです。文字起こしが詳しいほど、議事録として読みやすいとは限らない会議を正確に残そうとすると、できるだけ発言を全部残したくなります。でも、実際の会話には、「えー」「あの」「そう
0
カバー画像

「AI文字起こしはどこまで信用できる?」誤変換が起こりやすい5つの場面

AIを使った文字起こしは、本当に便利になりました。音声データを入れると、短時間で文章にしてくれる。以前なら何時間もかかっていた作業が、かなり楽になっています。私も、「文字起こしはAIでかなり効率化できるようになったな」と感じます。ただ、その一方で、「AIで文字起こししたから、もう確認しなくても大丈夫」とは言い切れません。かなり正確に見えても、よく読むと、人名が違う。専門用語が別の言葉になっている。数字が変わっている。といったことがあります。今回は、AI文字起こしで特に誤変換が起こりやすい場面について整理してみます。AI文字起こしは「かなり正確」と「間違えない」は違います最近のAI文字起こしは、以前と比べてかなり精度が上がっています。静かな場所で、一人が、はっきりした声で、一般的な言葉を話している。このような音声なら、かなり正確に文字になることがあります。そのため、パッと見ただけでは、「ほとんど間違っていない」ように感じます。でも、95%正確だったとしても、1時間の音声なら残りの5%はそれなりの量になります。さらに問題なのは、間違っている部分ほど重要な情報だったりすることです。① 複数人が同時に話している会議や座談会では、誰かが話している途中に、「そうですね」「私もそう思います」と別の人が話すことがあります。人間なら、声の違いや会話の流れから、誰が何を話しているのか分かることがあります。でもAIでは、発言が重なると、文章が途中で切れたり、2人の発言が一つにつながったり、話者を間違えたりすることがあります。特に議事録では、「誰が発言したのか」が重要になる場合があります。複数人が参加
0
カバー画像

「文字起こし=そのまま文章にする」ではありません|読みやすい文章に整える3つのポイント

会議やインタビュー、講義などの音声を文字にするとき、「聞こえた言葉を、そのまま入力すれば文字起こし」と思われることがあります。もちろん、一字一句そのまま残すことが必要な場面もあります。でも、実際の会話をそのまま文字にしてみると、意外と読みにくいものです。例えば、「えー、今回なんですけど、まあ、前回も少し話したんですけど、えっと、資料についてですね……」話しているときにはそれほど気にならなくても、文章になると少し読みづらく感じます。文字起こしでは、「音声を文字にすること」と「読める文章にすること」は、少し違います。今回は、文字起こしした文章を読みやすく整えるときに考えたい3つのポイントについて書いてみます。そもそも文字起こしにはいくつか方法があります「文字起こし」と一言でいっても、すべて同じ仕上げ方ではありません。よく使われるのが、素起こしケバ取り整文という方法です。素起こし「あのー」「えー」「そのー」なども含めて、基本的に発言をそのまま文字にします。話し方そのものを確認したい場合などには必要ですが、文章として読むとかなり読みにくくなることがあります。ケバ取り「あのー」「えー」といった、意味に大きく影響しない言葉を取り除きます。発言内容はできるだけ残しながら、読みやすくする方法です。整文話し言葉を、意味を変えない範囲で読みやすい文章に整えます。議事録や資料など、後から「読む」ことを目的にする場合には、この整理が必要になることがあります。① 「えー」「あのー」を全部残す必要があるか考える実際の会話では、「えー」「あのー」「まあ」「そのー」といった言葉をかなり使っています。話している
0
カバー画像

AIで文字起こししたら、そのまま使って大丈夫?意外と残る「聞き間違い」と「読みにくさ」

AIを使った文字起こしが、かなり身近になりました。会議やインタビュー、講義などの音声を入れると、短時間で文章にしてくれる。以前のように、音声を止めて、入力して、また再生して……を繰り返すことを考えると、本当に便利だと思います。私自身、まずAIで文字起こしをすること自体は十分ありだと思っています。ただ、そこで一つ気をつけたいことがあります。「文字になった」=「そのまま使える」ではありません。今回は、AIで文字起こしをした後に確認しておきたいポイントについてお話しします。AIの文字起こしはかなり便利になっています最近のAIによる文字起こしは、以前と比べてもかなり精度が高くなっています。録音状態が良く、一人ずつはっきり話していて、一般的な内容であれば、かなり自然に文章化されることもあります。そのため、「文字起こしだけならAIで十分では?」と思う方もいるかもしれません。実際、それで十分な場面もあると思います。ただし、問題になるのは、文字起こししたものを何に使うのかです。専門用語や固有名詞は間違うことがありますAIが苦手とするものの一つが、専門用語や固有名詞です。例えば医療・看護分野では、薬剤名、疾患名、処置名、医療機器、人名や施設名など、日常会話ではあまり使わない言葉がたくさん出てきます。前後の文章は合っているのに、重要な専門用語だけ別の言葉になっている。そんなこともあります。しかも文章として自然に見えると、間違っていることに気づきにくい場合があります。そのため、重要な音声ほど元の音声との確認が必要になります。話者が複数いると分かりにくくなることもあります会議やインタビューでは、一人だ
0
カバー画像

文字起こしで「聞き取り不明」を減らす音声準備の6ポイント

音声や動画の文字起こしは、渡すファイルの状態によっても確認の手間が変わります。依頼前に次の6点を確認しておくと、「聞き取り不明」や表記確認の往復を減らしやすくなります。1.元の音声・動画ファイルを用意する再生中の音声を別の端末で録り直すと、ノイズや反響が重なります。可能なら、録音・録画した元ファイルをそのまま用意します。圧縮や変換を繰り返したファイルしかない場合は、その旨も伝えておくと確認が早くなります。2.最初から最後まで再生できるか確認する冒頭や末尾が切れていないか、途中で音が止まらないかを一度確認します。長い無音、不要部分、文字起こし不要の区間がある場合は「5分30秒から12分まで」のように時間を指定すると範囲が明確です。3.小さな音・雑音のある場所を共有するエアコン音、屋外音、反響、マイクから遠い話者など、聞き取りにくい場所が分かっていれば先に伝えます。音声を加工して無理に消すより、元ファイルと該当時間を共有するほうが、言葉を取りこぼしにくいことがあります。4.同時に話している区間を伝える複数人が重なって話す部分は、声の区別が難しくなります。重要な発言が重なる場所だけでも時間を示し、話者名や発言内容の手がかりを添えると確認しやすくなります。5.固有名詞の正しい表記をまとめる人名、会社名、商品名、地名、専門用語は、聞き取れても漢字や英字表記を特定できない場合があります。正しい表記を箇条書きで共有し、読み方が特殊な語にはふりがなも添えます。6.権利と納品条件を確認する録音・録画・共有・文字起こしに必要な権利や許諾を確認し、納品形式、話者ラベル、言いよどみを残すか、タイムコー
0
カバー画像

非公開

2026年 3月10日 火曜日 混乱状態の国際状況の中で イランの最高指導者(後継者)が ジタバタ氏に決定するも 爆撃時の負傷で 式典? 欠席らしく その容体も不明だと聞きます。 今月の大きな予定として *月に二回の「女性ホルモン治療」  手術・入院していた病院へ *定期健診(診察&患部レントゲン撮影) *LGBTQ講演会(体験談)の三点。 ホルモン治療は肩への接種定期的に血液検査が有ります。 保険適用なので 助かっています。 定期健診 次の検診は多分 半年後 その後は多分 一年毎に・・。 だいたい そんなモノじゃないですか? 先日行った「イロハ」さん紹介の 教員の方々との懇談会では 許可を頂いての音声データが 私の勉強材料として 手元に有ります。 これを公開する事は無いのですが 私のトーク部分だけを切り抜いて それを公開するのは「有り」だと考えています。 仮に実現させるにしても 一応は「イロハ」さんに聞きますけれど・・。 非公開扱いにして YouTubeに保管しておくのも「良し」ですね。 ウクレレ奏者で シンガーソングライターの cotoriちゃんとの ツーショットトークも数本 YouTubeに非公開として保管しています。 只、 音声データだけなので 背景画像が無い訳なので iPhoneを移しながら 音声だけが流れている 静止画像みたいな違和感は残りますが。 これ、 録画中に着信が有ったら困るわぁ。 出ませんけれど ね。 画面に名前が表示されないように カバーを掛けるとか しましょうね。 尤も、 非公開なので 人目には出ないんですけれど。 今日時点で 公開されている私の動画は
0
カバー画像

文字起こしを外注する前に決めておく5つのこと

録音データを文字起こしに出すとき、音源だけを送ると「思っていた仕上がりと違う」が起きやすくなります。依頼前に次の5項目を決めておくと、確認や修正の往復を減らせます。1.文字起こしの使い道会議録の下書き、記事原稿、字幕、保存用の記録では、必要な整え方が異なります。最初に用途を伝えると、残す言葉と整理する言葉を判断しやすくなります。2.文章の整え方一言一句を残す「逐語」と、「えー」「あの」などを整理する「ケバ取り」は別の仕上げです。読みやすさを優先するならケバ取り、発言そのものが重要なら逐語が向いています。3.話者の表記複数人の音声では、「司会」「参加者A」のようなラベルでよいか、実名を入れるかを決めます。名前が必要な場合は、正しい漢字も一緒に共有します。4.固有名詞と聞き取りにくい箇所会社名、人名、商品名、専門用語は事前に一覧があると表記が安定します。聞き取れない箇所を推測で埋めるか、「不明」と明記するかも確認しておくと安心です。5.納品形式と確認方法Word、テキスト、タイムコードの有無など、実際に使う形式を指定します。受け取った後は、ファイルが開くか、話者名や固有名詞が合っているかを確認します。私は、音声・動画1本40分までの文字起こしを、ケバ取り・話者ラベル対応、Wordまたはテキスト形式で承っています。聞き取れない箇所は推測せず明記し、3日以内に納品します。必要な方はサービスページからご確認ください。
0
カバー画像

技術系の音声記録を書き起こす際に最も重視していること

自分が音声記録の書き起こしで最も重要視している点は、「読書百遍意自ずから通ず」という言葉にも通じますが、元の音声を必ず複数回通して聞くことです。倍速でもかまいませんが、最低でも2〜3回は全体を通します。■ 自動書き起こしツールの限界と問題点LIMOVoice などの自動書き起こしツールは大変便利ですが、実務で利用すると下記のような課題がしばしば発生します。 ・ 一般的な語彙でも誤変換される(特にカタカナ語で頻発) ・ 専門用語になると誤変換率がさらに上がる ・ 話者が被っている箇所の判別が困難 ・ 話者の切り替わりが誤って記録される ・ 会議全体の“流れ”が把握できないこれらの点を補正せずに文章化すると、情報精度が大きく低下してしまいます。■ 複数回「耳で通す」ことの重要性音声を耳で通して聞くことで、会議内容の流れが明確になり、専門用語や固有名詞も文脈の中で理解できます。また、 ・ 雑音が多い場所 ・ 無音時間が長い箇所なども把握できます。無音時間については Audacity を使えば一目瞭然ですが、耳で確認すると前後関係の理解が深まります。■ 自動生成テキストは「下書き」として活用する効率化のため、自動書き起こしで生成されたテキストを下書きとして使いますが、最終的な品質を左右するのは音声を聞きながらの丁寧な照合・修正です。手間はかかりますが、音声の内容と自動生成テキストを並行して確認することで、最も精度の高い書き起こしが可能になります。■ まとめ技術系の会議や現場音声は、専門性や環境によって難易度が変わります。そのため、自動書き起こしを用いるだけでなく、音声の複数回チェック
0
カバー画像

AI文字起こしは便利だが「そのまま使う」のは危険

AIの文字起こしソフトは非常に便利ですが、「そのまま使える」と思い込むと、痛い目を見ることがあります。以前、約2時間にわたる技術系の会議(建設会社様の「検査システム」に関する打ち合わせ)の音声を、LIMOVoiceで書き起こしした“生データ”のまま、関係者に共有したことがありました。すると返ってきた反応は、予想以上に厳しいものでした。「この、とりとめのない文章を読めというのか!」というクレームが複数寄せられました。確かに、AIの自動書き起こしでは「えー」「あー」「それから」「えっと」といった つなぎ言葉 が大量に残り、削除もされません。その結果、・冗長・要点が見えない・読み進める気力が削がれるという “読む側に負担の大きい議事録” になってしまいます。一方で、いきなりAI要約にかけると、今度は・重要な技術キーワード・議論の背景・話の前後関係が大きく省略され、会議の文脈そのものが失われることもあります。この経験から学んだのは、「AIで吐き出した結果を、そのまま使うのは危険」ということでした。手間はかかりますが、実際に音声を聞きながらテキストを確認し、人の目で整えることで、初めて「伝わる技術議事録」になります。効率化はできますが、完全な自動化は、まだ難しい。それが、実務で痛感した正直な感想です。専門用語が多い会議、研究打ち合わせ、技術検討会など、「AIだけでは不安な音声」の文字起こしについては、お気軽にご相談ください。もし、・AI文字起こしの精度に不安がある  ・専門用語が多く、そのまま共有できない  ・議事録を「読む側」から文句を言われた経験がある  といったお悩みがありましたら
0
10 件中 1 - 10