nvidia-smi
ollama run llama3
などを実行した際、モデル1. .bashrc
または .zshrc
を開く: nano ~/.bash_rc
# 特定のGPUを指定する場合(例:GPUが1枚なら0)
export OLLAMA_CUDA_VISIBLE_DEVICES=0
source ~/.bashrc
Modelfile.custom
)。 nano Modelfile.custom
FROM llama3
# コンテキスト長を8192に設定(例)
PARAMETER num_ctx 8192
# 温度(ランダム性)を調整したい場合
PARAMETER temperature 0.7
# Top-Pの調整
PARAMETER top_p 0.9
# ollama create [新しく付ける名前] -f [ファイルパス]
ollama create llama3-custom -f Modelfile.custom
ollama run llama3-custom
これで、`llama3-custom` を動かすときは設定したコンテキスト長が適用されます。
~/.bashrc
または ~/.profile
に記述します。| 変数名 | 設定例 | 説明 |
|---|---|---|
OLLAMA_HOST
|
0.0.0.0
|
外部(Windows側のブラウザなど)からアクセス可能にする場合に必要 |
OLLAMA_DEBUG
|
1
|
問題が起きたとき、詳細なログを出力する |
OLLAM_FLASH_ATTENTION
|
1
|
メモリ消費を抑えつつ高速化(一部モデルで有効) |
# 設定を書いた後
source ~/.bashrc
nvidia-smi
でドライバを見直し、必要なら OLLAMA_CUDA_VISIBLE_DEVICES
を設定。ollama create
する。
Natural Language Analytics with Generative Large-Language Models: A Practical Approach with Ollama a NATURAL LANGUAGE ANALYTICS W/G (Springerbriefs in Computer Science) [ Francisco S. Marcondes ]
アンソロピックのIPO目論見書の件 KIM… 2026.10.02
Microsoft Foundry Localを使って NPU付… 2026.09.29
ClaudeCodeもCodexもGoogle AIも全部やめ… 2026.09.28
PR
Calendar
Category