ビジネス応用初出 6/11 02:54
CCL25-Eval Task 5:新しいデータセットとLoRAファインチューニングされたQwen2.5のシステムレポート
System Report for CCL25-Eval Task 5: New Dataset and LoRA-Fine-Tuned Qwen2.5
https://export.arxiv.org/api/query2026/6/11
AI要約
古典中国語翻訳と詩生成におけるLLMの応用について、CCL25-Evalタスク5のシステムレポートを提示。ドメイン固有の課題、特に詩の鑑賞における感情的・意味的理解の難しさに言及し、新しいデータセットとQwen2.5のLoRAファインチューニングについて報告。
AI要点
- 古典中国語詩の翻訳と感情的意味理解に特化したLLM「PoetryQwen」が開発された。
- CCPoetry-49Kという、49,404件の高品質な指示応答ペアからなる新しいデータセットが構築された。
- Qwen2.5-14BモデルにLoRA(Low-Rank Adaptation)を適用し、ドメイン特化ファインチューニングを行った。
- CCL25-Eval Task 5ベンチマークで、ベースラインモデル(Qwen2.5-14B-Instruct)と比較してスコアが9.7%向上した(0.690→0.757)。
なぜ重要か
古典中国語詩という特定ドメインに特化したデータセットとLLMチューニング手法を開発することで、詩の精密な翻訳と感情的意味の理解能力を大幅に向上させ、文化遺産のデジタルアーカイブと研究に貢献する。