決算電話会議トランスクリプト:調査とデータガイド
ソースまたはタイミングを失うことなく、経営陣の通話をどのように取得、構造化、検証、および分析するか。
決算電話会議トランスクリプトは、経営陣の準備された発言とアナリストの質疑応答を記録します。調査準備完了トランスクリプトには、企業ID、会計期間、通話時間、公開時間、ソースと権利、スピーカーと役割、セクション境界、文書バージョン、および関連する決算イベントと提出書類への安定したリンクが含まれます。
構造が重要
準備された発言と質疑応答は、異なるインセンティブと言語を持っています。検索またはNLPのためにクリーニングされた表現が作成される場合でも、スピーカーのターン、オペレーターのテキスト、アナリストのID、および役割は利用可能であるべきです。
元の文書とハッシュを保持します。訂正、スピーカーの修正、および後からのシンジケートコピーは、以前のモデルで使用された証拠を変更するのではなく、バージョンを作成する必要があります。
時間と権利が重要
通話時間は、トランスクリプトの公開時間と必ずしも同じではありません。歴史的なモデルは、シミュレートされたカットオフ時点で利用可能だったテキストのみを使用でき、認識遅延を記録する必要があります。
公開ページは依然として著作権で保護されている場合があります。取得ツールやプロキシは再配布権を作成しません。所有、ライセンス、またはその他の許可されたソースからのみ完全なテキストを提供してください。
- 通話時間と公開タイムスタンプを分離する。
- 準備された発言と質疑応答を保持する。
- スピーカー、ソースURL、および文書ハッシュを保持する。
- 利用不可または制限付きテキストを明示的に報告する。
提出書類のタイムラインで分析する
各通話をその会計期間、決算イベント、SEC提出書類、ファンダメンタルズ、および後続の市場ウィンドウに結合します。これにより、経営陣の言葉と、それ以前またはそれ以降に提出された事実を区別できます。
バージョン管理されたトピックモデル、埋め込み、要約、およびセンチメントをソーストランスクリプトとは別にバージョン管理して、パーサーが変更されたときに派生結果を再生成できるようにします。
Key takeaways
- 01元のテキストとスピーカー構造を保持する。
- 02公開時間をテキスト認識時刻として使用する。
- 03テキスト権限をクロール可能性とは別に扱う。
- 04NLP出力を個別にバージョン管理する。