Ollama 0.7実行設定。Environment: OLLAMA_GPU_LAYERS(GPU Offload layer数)・OLLAMA_NUM_PARALLEL(並列)・OLLAMA_MAX_LOADED_MODELS・Mac Metal(Apple Silicon自動)・Windows/Linux CUDA(RTX GPU)・ROCm(AMD)・CLI: ollama pull llama3.3:70b・ollama run qwen2.5-coder:32b・ollama serve・API: localhost:11434・n_ctx context増強・quantization Q4_K_M/Q8_0、2026年Mac Studio M4 Max 128GB で70B Q4local定着。