モデル学習と適応
- — 日本語の事前学習・継続事前学習
- — 口語・非formal日本語へのドメイン適応
- — 対話・マルチターン応答のモデリング
- — 非標準表記に対するトークナイザの開発・評価
- — スレッド構造を用いた指示・選好データの構築
評価とベンチマーク
- — 口語・スラング・語彙変化に対する理解度評価
- — スレッド会話の理解とレス帰属の評価
- — トピック分類・モデレーションモデルの評価
- — 時期別テキストに対する汎化性能の測定
- — 期間指定によるコンタミネーション制御済み評価セット
検索・retrieval・プロダクト利用
- — 日本語RAG・回答生成のための検索コーパス
- — 口語クエリの意図理解・分類
- — レコメンド・話題トレンド検出
- — 消費者言説からの固有表現・製品言及抽出
研究
- — 社会言語学・通時的言語変化
- — 情報伝播・公共言説の分析
- — 長期コミュニティデータの計算社会科学
許諾される利用範囲は、締結するライセンス契約において個別に定めます。本ページに用途を掲載していることは、当該用途に対する権利許諾を意味するものではありません。
データサンプルをご請求ください。
適格な組織の方には、代表的な技術サンプル、スキーマ仕様書、データセット概要をご提供します。