コーパス分析ツール(無料)KWIC・コロケーション・キーワード分析
学習者作文や教科書・論文のテキストを貼る/.txtを複数読み込むだけで、KWICコンコーダンス(分布プロット付き)、共起語(MI・t・LL・logDice)、語彙の束(n-gram)、単語リスト(DP)、参照コーパスとのキーワード分析(LL・Log Ratio・%DIFF)をブラウザ内で。
学習者作文や教科書・論文のテキストを貼る/.txtを複数読み込むだけで、KWICコンコーダンス(分布プロット付き)、共起語(MI・t・LL・logDice)、語彙の束(n-gram)、単語リスト(DP)、参照コーパスとのキーワード分析(LL・Log Ratio・%DIFF)をブラウザ内で。
学習者のエッセイや教科書本文、論文サンプルなど手元の英文を、その場でコーパスとして分析できる無料のブラウザツールです。インストール不要で、テキストは外部に送信されません。KWICと出現位置プロット、MI・t-score・対数尤度・logDiceによる共起語、語彙の束(n-gram)、DP付き単語リスト、対数尤度とLog Ratioによるキーワード分析を5つのタブで。計算式と文献を画面で確認でき、独立したPython実装と照合済みです。
無料で、インストールも登録も不要です。ブラウザで開き、英文を貼り付けるか .txt ファイルを読み込むだけで使えます。
いいえ。解析はすべてお使いのブラウザ内で行われ、テキストが外部のサーバーに送信されることはありません。貼り付けた本文と設定はこのブラウザ(localStorage)にだけ保存されます(大きなテキストは保存されません)。
MI = log₂(O/E)、t = (O − E)/√O、logDice = 14 + log₂(2O/(f(n)+f(c)))、対数尤度は 2×2 表の G² です。期待値 E は窓幅補正あり(f(n)·f(c)·窓幅/N、AntConc 4 や Brezina (2018) の補正式と同じ定義)と補正なしを選べます。ソフトによって期待値や窓の数え方が異なるため、論文では用いた設定を明記してください。計算式と文献は画面の「📚 計算式と文献」で確認できます。
100万字程度(約17万語)のテキストでも、ブラウザ上で数秒以内に処理できるよう設計しています。複数の .txt をまとめて読み込むと、ファイルごとに文書として扱われ、レンジや DP(散らばり)の計算に使われます。
Lancaster 大学 UCREL の Paul Rayson による Log-likelihood and effect size calculator と同じ式(Rayson & Garside, 2000)で計算しており、同 calculator の計算シートの例題で対数尤度・%DIFF・Log Ratio が一致することを確認しています。ただし、語の区切り方(トークン化)の設定が異なると頻度そのものが変わるため、他のソフトとは結果が異なる場合があります。