シリーズ・全7本

日本語RAGの検索品質

RAGで必要な文書を検索できないとき、見直す候補はモデルだけではありません。このシリーズでは日本語の評価データを使い、埋め込みモデル・チャンク分割・リランカー・ハイブリッド検索・クエリ拡張という工程を一つずつ切り分けて測っています。まず入口記事で取りこぼしと順位を診断し、見直す工程を決められます。比較結果と処理時間から、どの工程を改善するか判断するためのシリーズです。

困っていることから選ぶ

連載順に読む