元旦なので社長(AI)にElyza13Bを使ってクリーンで自由な会話データセットを作ってもらってみた|shi3z
著者が ELYZA の13Bモデルを動かし、Wikipedia から日本語の複数往復会話を生成した実験。例示プロンプト、生成コード、崩れた出力も含む観察を公開している。
A100を8基搭載した環境で量子化せずに推論し、先生と生徒の会話形式へ変換。例示の与え方を工夫した一方、引用符や項目名が崩れ、構造化データとしての修正が必要だったと報告する。
学習・実装:Wikipedia 本文と会話例を渡す Transformers の生成コード/確認 2026-09-14/https://note.com/shi3zblog/n/nab7a9e7d7a6c
学習・観察:会話は生成できても引用符や内容の整合に課題/確認 2026-09-14/https://note.com/shi3zblog/n/nab7a9e7d7a6c
対象:AIの開発・導入・活用を検討する担当者。形式:企業・著者による公開記事。言語:日本語(公開本文で確認)。利用条件:公開記事(本文をログインなしで確認)
確認事項(編集部):見出しの「自由な」「クリーン」は権利確認の証明ではない。掲載例には事実誤りと構文不備があり、そのまま学習用に使える品質は確認されていない。
出典:shi3z「元旦なので社長(AI)にElyza13Bを使ってクリーンで自由な会話データセットを作ってもらってみた」/公開・更新情報:2024-01-01/確認日:2026-09-14/https://note.com/shi3zblog/n/nab7a9e7d7a6c
株式会社世良(Sera, Inc.)/ お問い合わせ: info@sera-inc.co.jp