驚異のLLMテクノロジーentropixを8Bに拡張するとどうなったか?|shi3z
entropix の推論処理を Llama 3.1 系の 8B モデルに合わせて改変した著者の実験。小数の比較に失敗する応答と、指示を変えた後の応答を並べている。
1B 向けコードをフォークし、重みとトークナイザーを変更した経緯を説明。小数比較、一般知識、日本語の文章生成を試し、追加の指示が回答の長さや内容に与える影響を観察している。
学習・改変対象:8B モデル用のコードとモデル切替を紹介。/確認 2026-09-14/https://note.com/shi3zblog/n/ne01f75657fb7
学習・失敗を含む記録:小数比較の誤答と具体的な計算指示を加えた結果を掲載。/確認 2026-09-14/https://note.com/shi3zblog/n/ne01f75657fb7
対象:AIの開発・導入・活用を検討する担当者。形式:企業・著者による公開記事。言語:日本語(公開本文で確認)。利用条件:公開記事(本文をログインなしで確認)
確認事項(編集部):少数の例とプロンプト変更を伴う試験。サンプラー単独の性能改善やモデル規模に関する因果関係は立証されていない。
出典:shi3z「驚異のLLMテクノロジーentropixを8Bに拡張するとどうなったか?」/公開・更新情報:2024-10-14/確認日:2026-09-14/https://note.com/shi3zblog/n/ne01f75657fb7
株式会社世良(Sera, Inc.)/ お問い合わせ: info@sera-inc.co.jp