概要
- 英語の不定冠詞「a」と「an」の使い分けのルール解説
- 書かれた文字ではなく、発音で判断する必要性
- 例外的な単語の存在とその頻度のデータ分析
- 可視化による例外パターンの検証
- コード作成の工夫や反省点の共有
英語の不定冠詞「a」と「an」の使い分け
- 英語では 不定冠詞 として「a」または「an」を名詞の前に使用
- 例:「a raccoon」や「an apple」など、単語によって使い分け
- 単純に 最初の文字 で判断すると誤りが発生
- 例:「an unicorn」ではなく「a unicorn」が正しい
- 実際のルールは 発音 が母音で始まるかどうかで決定
- 「unicorn」は「u」で始まるが、発音は 子音音(/j/)
- 「hour」は「h」で始まるが、発音は 母音音(/aʊ/)
例外単語の頻度とグループ化
- どの程度例外が存在するかを データ分析 で調査
- 可視化によって 最初の2文字 で判別できるかを検証
- 約32,455語の中で、例外は 129語 のみという結果
- 例外単語の割合は非常に 低い
- 例外単語は グループ化 が可能
コード作成とその反省点
- 今回の分析は 一時的なコード で実施
- コードの 保守性や可読性 よりも 正確性 を重視
- cmudictの解析やd3.jsの再学習に 多くの時間 を費やしたことを反省
- LLM(大規模言語モデル)を活用すれば 効率化 できた可能性
- trie簡略化アルゴリズムに より多くの時間 を割くべきだったという気付き