Pinned
ニッチすぎて凄さが伝わらなさそうですが(悲しみ)、Web から収集した人名・固有名詞など大量の単語・読みのペアに対し、辞書 CSV の「品詞4分類」「名前の姓名境界」「アクセント核位置/結合規則」「生起コスト」を高精度に予測する NN エンジンを自作して辞書パイプラインに組み込んだりしてました
(労働ツイート)去年の7月23日にリリースしてから、早いものでサービス開始1周年を迎えました!
手が足りず中々新機能追加などをやれてない状況ではありますが、裏では読み精度改善のため辞書生成パイプラインを8万行で書き直したりひたすら地道に改善しております(既に API には反映済みです!)




