【エンジニア向け】Ollama Pythonライブラリ徹底解説:ローカルLLMをアプリケーションに手軽に組み込む方法


【エンジニア向け】Ollama Pythonライブラリ徹底解説:ローカルLLMをアプリケーションに手軽に組み込む方法

ollama/ollama-python

2025-10-09

「Ollama Python library」は、ローカル環境で動作するLLM実行環境「Ollama」を、Pythonコードから簡単に操作するための公式ライブラリです。

これがエンジニアにとってどのように役立つかというと、主に以下の点があります。

統合・自動化のしやすさ

Pythonスクリプトや既存のアプリケーションにLLMの機能をシームレスに組み込むことができます。例えば、Webアプリケーションのバックエンド、データ処理パイプラインの一部、自動テストの生成などに使えます。

コマンドラインでollama runを実行するよりも、プログラム内で動的にプロンプトを変えたり、結果を後続の処理に渡したりといった自動化が格段に簡単になります。

プロトタイピングと開発コスト削減

クラウドのLLM API(有料)を使う前に、ローカルで無料のオープンソースLLM(例
Llama 3, Phi-3など)を使って、機能のプロトタイピングや検証を素早く行えます。

API利用料を気にせず、開発初期段階で何度も試行錯誤できるため、開発コストを抑えられます。

ストリーミング処理

大規模な応答を待つことなく、トークンが生成されるたびにリアルタイムで処理できるストリーミング機能を簡単に実装できます。これは、チャットアプリケーションなどでユーザー体験を向上させるために非常に重要です。

環境の統一

OllamaをDockerなどでコンテナ化すれば、開発環境と本番環境でLLMの実行環境を統一しやすくなります。

Ollama Python libraryを使うには、まずベースとなるOllama本体が動作している必要があります。

まず、Ollama公式サイトから、お使いのOS(macOS, Windows, Linux)に合ったアプリケーションをダウンロードし、インストールして起動しておきましょう。

Pythonから利用したいLLMモデルを、事前にOllamaにダウンロードしておきます。ターミナル(またはPowerShell/コマンドプロンプト)で以下のコマンドを実行します。

# 例:Llama 3をダウンロードする場合
ollama pull llama3

Ollama本体が起動し、モデルもダウンロードできたら、Python環境に公式ライブラリをpipでインストールします。

pip install ollama

これで準備完了です!

ここからは、具体的なPythonコードで、Ollama Python libraryの基本的な使い方を見ていきましょう。

最も基本的な使い方です。ユーザーのプロンプトに対してモデルに回答させます。

import ollama

# モデルに質問を投げる
response = ollama.chat(
    model='llama3',  # 使用したいモデル名(Step 2でダウンロードしたもの)
    messages=[
        {
            'role': 'user',
            'content': '猫がモチーフのプログラミング言語は何ですか?',
        },
    ],
)

# 応答内容を表示
# response['message']['content'] に回答テキストが含まれています
print("モデルの回答:")
print(response['message']['content'])

応答が大きい場合や、リアルタイム性が求められるチャットUIなどを開発する際に、ストリーミング機能を使うと便利です。

import ollama
import sys

# stream=True を指定すると、応答がジェネレーターとして返されます
stream = ollama.chat(
    model='llama3',
    messages=[
        {
            'role': 'user',
            'content': 'ソフトウェアエンジニアの生産性を高めるためのアイデアを5つ、箇条書きで提案してください。',
        },
    ],
    stream=True  # ストリーミングを有効化
)

print("モデルの回答(ストリーミング):")
for chunk in stream:
    # チャンクごとにテキストを取得して表示
    if chunk['message']['content'] is not None:
        print(chunk['message']['content'], end='', flush=True)

# 最後に改行
print()

messagesリストに、過去のやり取り(role: userrole: assistant)を追加していくことで、文脈を理解した会話を継続させることができます。

import ollama

# 過去の会話履歴をリストで保持
messages_history = [
    {
        'role': 'user',
        'content': '私が好きな動物は、忠実で賢い犬です。',
    },
]

# 1回目の応答
response1 = ollama.chat(
    model='llama3',
    messages=messages_history
)
print(f"モデル1回目の応答: {response1['message']['content']}\n")

# 1回目の応答を履歴に追加(モデルからの応答は 'assistant' ロール)
messages_history.append(response1['message'])

# 2回目の質問 (文脈依存)
messages_history.append({
    'role': 'user',
    'content': 'その動物を飼う上での一般的な注意点を3つ教えてください。'
})

# 2回目の応答(履歴全体を渡す)
response2 = ollama.chat(
    model='llama3',
    messages=messages_history
)
print(f"モデル2回目の応答: {response2['message']['content']}")

現在ローカルで利用可能なモデルの一覧を取得したい場合は、list()関数を使います。

import ollama

# ローカルにインストールされているモデルの一覧を取得
models = ollama.list()

print("ローカルにインストールされているモデル:")
for model in models['models']:
    print(f"- {model['name']} (サイズ: {round(model['size'] / (1024**3), 2)} GB)")

ollama/ollama-python




ソフトウェアエンジニアのためのtheHarvester入門: セキュリティとOSINT活用法

今日はlaramies/theHarvesterについて、ソフトウェアエンジニアの皆さんに役立つ情報をお届けしますね!theHarvesterは、まるで雲の中から雨粒を探すように、インターネットの広大な情報の中から、メールアドレスやサブドメインといった貴重な情報を収集してくれる、とっても賢いツールなんです


宇宙飛行士のためのAIツールキット:TensorZeroでLLM開発を加速せよ

今回紹介するのは、「TensorZero」という、LLMアプリケーション開発のためのオールインワンの宇宙船だ。このツールを使いこなせば、君はより少ない燃料(労力)で、より遠い宇宙(成功)へと到達できるはずだ。ソフトウェアエンジニアリングの観点から見ると、TensorZeroはLLM(大規模言語モデル)を扱うプロジェクトにおける、「信頼性と効率」を劇的に向上させるための、まるで宇宙船のコックピットのような存在だ。


Pythonエンジニア必見!次世代スクレイピングフレームワーク『Scrapling』完全ガイド

今日はエンジニアの姫のために、最近業界で「超イケてる」って噂のスクレイピング・フレームワーク『Scrapling』について、俺がエスコートするみたいに優しく教えてあげるよ。これを使えば、面倒なデータ収集も俺の接客くらいスマートに片付いちゃうから、しっかり見ててね。


daveebbelaar/ai-cookbookをゴルフ場に例える:AI開発への実践的アプローチ

daveebbelaar/ai-cookbookは、AIシステムを構築したいソフトウェアエンジニアにとって、まさに広大なゴルフ場のようなものです。多様なコース(例)が揃っている ゴルフ場にはショートホールからロングホールまで多様なコースがあるように、このリポジトリには画像認識、自然言語処理、データ分析など、様々なAIアプリケーションの「例」が揃っています。


Big Techも注目のAIパワーをセキュリティに。PentestGPTで効率化する侵入テストの最前線

今回は、サイバーセキュリティの分野で非常に注目されている、LLM(大規模言語法モデル)をペネトレーションテスト(侵入テスト)に活用したツール「PentestGPT」について解説します。Big Tech(Apple, Google, Amazonなど)が提供する最先端のAI技術を、実際の現場でどう「武器」として使うか、という視点でお話ししますね。


ソースコードで金融市場を支配する:QuantConnect/Leanで実現する自動取引戦略の開発・検証・実行

「QuantConnect/Lean」(クオンコネクト・リーン)は、一言で言えば、Python や C# を使って、自分で考えた株や FX などの金融商品の取引戦略(アルゴリズム)を開発・検証・実行するための、オープンソースのアルゴリズム取引エンジンです!


nautechsystems/nautilus_trader:アルゴリズム取引の未来を創る

皆さん、こんにちは。お集まりいただき、ありがとうございます。本日は、金融とテクノロジーの融合が生み出した、非常に興味深いプロジェクトについてお伝えします。ご紹介するのは、nautechsystems/nautilus_trader。これは、高性能なアルゴリズム取引プラットフォームであり、イベント駆動型のバックテスターとしても機能する、まさにソフトウェアエンジニアにとっての宝箱のような存在です。


クレーンゲームの達人から学ぶ!「Resume Matcher」で理想の転職を掴み取れ

やぁ、未来のトップエンジニアの卵たち!そして、今まさにキャリアアップを目指す現役エンジニアの皆さん!突然ですが、皆さん、クレーンゲームは得意ですか? 私はですねぇ、昔からどうも苦手でして…。アームが掴んだと思ったら、スルッと落ちていくあの絶望感、たまらないですよねぇ(白目)。


オレオレ詐欺に注意...じゃない!GitHubDailyで良質な情報を安全に手に入れる方法

GitHubDaily/GitHubDaily は、その名の通り、GitHub上で見つけられた高品質で興味深い、実用的なオープンソースプロジェクトを毎日共有しているリポジトリです。新しいプログラミング言語、フレームワーク、開発ツール、面白い技術チュートリアルなど、多岐にわたるプロジェクトが紹介されています。