https://huggingface.co/elyza/ELYZA-japanese-CodeLlama-7b-instruct をローカルで動作させるデモアプリ
OS: Windows11
メモリ: 64 GB
GPU: NVIDIA GeForce RTX 4090
CPU: Intel Corei9-14900KF
docker compose upでdockerコンテナを起動する
http://localhost:8080/にアクセスする
以下のデモ画面のWhat is up?の部分に質問したいことを記載

画面: stremlit
モデルライブラリ: transformers
多人数アクセス: アクセス制御などは実施していないので、アクセス数が増えるとメモリエラーになる可能性あり
会話履歴に応じた解答の生成
1 commits
Python
89.8%
Dockerfile
10.2%
https://huggingface.co/elyza/ELYZA-japanese-CodeLlama-7b-instruct をローカルで動作させるデモアプリ
OS: Windows11
メモリ: 64 GB
GPU: NVIDIA GeForce RTX 4090
CPU: Intel Corei9-14900KF
docker compose upでdockerコンテナを起動する
http://localhost:8080/にアクセスする
以下のデモ画面のWhat is up?の部分に質問したいことを記載

画面: stremlit
モデルライブラリ: transformers
多人数アクセス: アクセス制御などは実施していないので、アクセス数が増えるとメモリエラーになる可能性あり
会話履歴に応じた解答の生成
1 commits
Python
89.8%
Dockerfile
10.2%