Hardware

テスト: Ollama がインテル CPU のパフォーマンスコアと効率コアをどのように利用しているか

テスト: Ollama がインテル CPU のパフォーマンスコアと効率コアをどのように利用しているか

インテルCPUにおけるOllamaの効率的なコアとパフォーマンスコアの比較

私はある仮説をテストしたいと思っています。すなわち、「インテルCPUのすべてのコアを活用することで、LLMの速度が向上するか?」というものです。このテストについては、ALL cores on Intel CPU would raise the speed of LLMs?をご覧ください。

新しいgemma3 27bitモデル(gemma3:27b、ollama上では17GB)が私のGPUの16GB VRAMに収まらず、部分的にCPU上での実行に頼っているという点が気になります。

Ollamaの並列リクエスト処理方法

Ollamaの並列リクエスト処理方法

Ollamaの並行性、キューイング、およびOLLAMA_NUM_PARALLELのチューニング方法を理解し、安定した並列リクエストを実現します。

本ガイドでは、Ollamaが並列リクエストをどのように処理するか(並列性、キューイング、リソース制限)および、OLLAMA_NUM_PARALLEL 環境変数(および関連する設定項目)を使用してどのようにチューニングするかを説明します。

エプソン エコタンク ET-8500 リナックスドライバーのインストール

エプソン エコタンク ET-8500 リナックスドライバーのインストール

古いプリンタードライバと比べてはるかに簡単です

ET-8500をWindowsにインストールする方法は、マニュアルに詳細に記載されています。ET-8500 Linuxドライバのインストールは簡単ですが、簡単ではありません。このガイドは、2026年のドキュメントツール: Markdown、LaTeX、PDFおよび印刷ワークフロー ハブの一部です。

大規模言語モデルの速度テスト

大規模言語モデルの速度テスト

LLMのGPUとCPUでの速度をテストしてみましょう

いくつかのLLM(大規模言語モデル)のバージョン(llama3(メタ/Facebook)、phi3(マイクロソフト)、gemma(グーグル)、mistral(オープンソース))におけるCPUおよびGPUでの予測速度の比較。