メインコンテンツまでスキップ

AI字幕性能改善のお知らせ

お知らせ

このドキュメントは機械翻訳で作成された下書きであり、現在レビュー中です。機械翻訳の特性上、一部の内容が不正確であったり、韓国語の原文と異なる場合があります。より正確な情報については、韓国語のドキュメントをご参照ください。

Kollus AI字幕サービスをご利用いただいている運営者様に心より感謝申し上げます。

運営者様の貴重なフィードバックを基に、より自然で正確な字幕を提供するため、AI字幕生成性能を大幅に改善しました。主なアップデート内容を以下のとおりご案内いたします。


🔧 主な改善内容

文脈認識に基づく単語選択

  • 改善機能: 音声認識時に文脈上最も適切な単語を選択する性能が向上しました。
  • 詳細内容: 韓国語の統計的言語モデルである N-gram を導入し、発話の前後の流れを精密に分析します。発音が似ていて混同しやすい単語候補群の中から、全体の文脈上最も自然な単語を自ら判断して選択します。

字幕シンクと文章分割タイミングの最適化

  • 改善機能: 実際の音声と、字幕が表示・消滅するタイミングのシンクがより正確になりました。
  • 詳細内容: 2つの音声認識エンジンの結果を統合するプロセスを精緻化しました。これにより、実際の話す速度と流れに合わせて、字幕表示タイミングと文章の区切り位置(フレーズ分割)をスムーズに調整しました。

よく誤認識される表現の自動修正

  • 改善機能: AI が繰り返し誤認識していた特定の単語や表現を自動的に修正します。
  • 詳細内容: 実際の誤認識事例データを分析して構築した自動修正ルールを適用しました。正常な文章まで歪んでしまう現象を防ぐため、AI が単語の発音と文脈を総合的に相互検証した上で、安全な場合にのみ自動修正を実行します。

背景音/無音区間の異常字幕の除去

  • 改善機能: 音声がない区間で任意の字幕が生成される現象を防止します。
  • 詳細内容: 音楽やノイズのみの背景音区間、あるいは無音区間でランダムなテキストが生成されていた AI 幻聴現象(Hallucination)を解決しました。繰り返し単語の検出・除去アルゴリズムを強化し、実際の人物の発話区間にのみ正確に字幕が生成されるよう改善しました。

サービスご利用方法