AI generated thumbnail

UnslothでQwen2.5-32Bを17GB VRAMで動かす環境構築ガイド

所要時間: 約45分 | 難易度: ★★★☆☆ この記事で作るもの Qwen2.5-32B(または次世代27Bクラス)をVRAM 17GB以下でロードし、高速に推論・学習させるPython環境 ローカルLLM特有の「メモリ不足(OOM)」を回避しながら、商用モデル級の回答精度を引き出すスクリプト Google Colabや手元のRTX 3060/4060 Ti(16GB)でも動作を狙える最適化設定 📦 この記事に関連する商品(楽天メインで価格確認) ...

2026年8月3日 · 9 分 · 4116 文字 · Negi AI Lab
AI generated thumbnail

OllamaとOpen WebUIで自分専用のローカルLLM環境を構築する方法

所要時間: 約30分 | 難易度: ★★☆☆☆ この記事で作るもの インターネット不要で機密情報を放り込んでも安心な、自分専用のChatGPTクローン環境を構築します。 前提知識:ターミナルでコマンドをコピペできる、Dockerの概念をなんとなく知っている。 必要なもの:Windows/Mac/Linux PC、インターネット接続(モデルのダウンロード用)。 📦 この記事に関連する商品(楽天メインで価格確認) ...

2026年8月1日 · 8 分 · 3880 文字 · Negi AI Lab
AI generated thumbnail

llama.cppとGGUFでローカルLLM環境を高速に構築する方法

所要時間: 約40分 | 難易度: ★★☆☆☆ この記事で作るもの Llama 3などの最新LLMを、自分のPCのGPUをフル活用して高速に動かすPythonサーバーを作ります。 前提知識:ターミナルでの基本的なコマンド操作、Pythonの基礎(仮想環境の構築ができる程度)。 必要なもの:NVIDIA製GPU(VRAM 8GB以上推奨)を搭載したWindows PC、またはApple Silicon搭載のMac。 📦 この記事に関連する商品(楽天メインで価格確認) ...

2026年7月21日 · 9 分 · 4134 文字 · Negi AI Lab
AI generated thumbnail

OllamaとOpen WebUIを連携させ、完全にオフラインで動作する「プライベートChatGPT環境」を構築します。

この記事を読み終える頃には、社外秘の資料を読み込ませても情報漏洩の心配がない、あなた専用の高機能なAIアシスタントが手元のPCで動いているはずです。 所要時間: 約30分 | 難易度: ★★☆☆☆ この記事で作るもの Webブラウザから操作でき、PDF等のドキュメント解析(RAG)も可能なローカルLLM環境 LLM実行エンジンとして「Ollama」、UIとして「Open WebUI」を組み合わせたスタック 前提知識:ターミナル(コマンドプロンプト)でのコピペ操作、Dockerの基本的な概念 📦 この記事に関連する商品(楽天メインで価格確認) ...

2026年7月20日 · 8 分 · 3911 文字 · Negi AI Lab
AI generated thumbnail

llama.cpp 使い方 入門:GGUF量子化モデルをローカルPCで爆速動作させる方法

所要時間: 約30分 | 難易度: ★★★☆☆ この記事で作るもの Llama 3.1やMistralなどの最新オープンソースLLMを、自分のPC(Windows/Mac)のGPUを活用して高速に動作させるPython実行環境を構築します。 量子化技術(GGUF)を使い、本来なら数十GBのVRAMが必要な巨大モデルを、一般的なゲーミングPCやMacBookでサクサク動かせるようにします。 最終的に、PythonからローカルLLMを呼び出し、チャット形式で応答を返すスクリプトを完成させます。 📦 この記事に関連する商品(楽天メインで価格確認) ...

2026年7月16日 · 9 分 · 4060 文字 · Negi AI Lab
AI generated thumbnail

MLX 使い方 入門 Apple Silicon ローカルLLM 構築方法

所要時間: 約30分 | 難易度: ★★☆☆☆ この記事で作るもの Apple Silicon(M1/M2/M3/M4)のGPU性能を最大限に引き出し、ネット接続なしで高速に動作するローカルLLMチャット用Pythonスクリプトを作ります。 「mlx-lm」というライブラリを活用し、Hugging Face上の数千種類のモデルを数行のコードで切り替えて、仕事で使えるレスポンス速度を実現するのがゴールです。 ...

2026年7月16日 · 9 分 · 4499 文字 · Negi AI Lab
AI generated thumbnail

llama.cppとGGUFを使って手元のPCで高性能なLLMを高速動作させる環境を構築します。

クラウドに課金せず、VRAM 12GB程度のコンシューマーGPUやApple Silicon Macで、7B〜14Bクラスのモデルを「実用速度」で動かす手法を解説します。 この記事の手順を終える頃には、自分のPC内にプライベートなAIチャット環境が完成しています。 ...

2026年7月11日 · 9 分 · 4082 文字 · Negi AI Lab
AI generated thumbnail

llama.cppとGGUF量子化でローカルLLM構築入門

所要時間: 約45分 | 難易度: ★★★☆☆ この記事で作るもの お手元のPCでLlama 3.1やMistralなどの最新AIを、商用API(GPT-4等)に頼らず完全オフラインで動かす推論環境を構築します。 具体的には、C++ベースの高速推論エンジン「llama.cpp」をビルドし、量子化されたGGUF形式のモデルをPythonからOpenAI互換APIとして呼び出す仕組みを作ります。 最終的に、プライベートなデータを一切外に出さない「自分専用のAIチャットサーバー」が手に入ります。 📦 この記事に関連する商品(楽天メインで価格確認) ...

2026年7月10日 · 9 分 · 4220 文字 · Negi AI Lab
AI generated thumbnail

ローカルLLM用GPUの選び方2025|RTX 5090を待つべきか3090を中古で買うべきか

3行要約 結論:Llama 3 70Bクラスを業務で使うなら、VRAM 48GB(RTX 3090/4090の2枚挿し)が最低ラインです。 判断軸:推論速度(token/sec)を重視するならRTX 4090、コスト優先なら中古のRTX 3090、開発の安定性ならMac Studio 128GB以上を選んでください。 注意:電源容量(1200W以上必須)と排熱対策を無視すると、1枚20万円以上のGPUが熱暴走で即座に文鎮化します。 📦 この記事に関連する商品(楽天メインで価格確認) ...

2026年7月10日 · 7 分 · 3057 文字 · Negi AI Lab
AI generated thumbnail

MLX 使い方 入門:Apple SiliconでローカルLLMを動かす方法

所要時間: 約30分 | 難易度: ★★☆☆☆ この記事で作るもの Apple Silicon(M1/M2/M3/M4)のGPU性能を最大限に引き出し、Llama 3などの最新LLMと高速に対話できるPythonスクリプト 外部APIに一切頼らず、完全にオフラインで動作するプライバシー重視のチャットインターフェース 前提知識:Pythonの基本的な構文(変数、関数、pip操作)がわかること 必要なもの:Apple Silicon搭載のMac、Python 3.10以降 📦 この記事に関連する商品(楽天メインで価格確認) ...

2026年6月26日 · 9 分 · 4138 文字 · Negi AI Lab