サービス内容

セキュアなローカルLLM環境の構築から、業務に合わせたカスタマイズまで、 お客様のAI活用をトータルでサポートします。

ローカルLLM環境構築

クラウド上のAIサービスを利用せず、自社専用の環境に大規模言語モデル(LLM)を構築します。オンプレミスサーバーはもちろん、AWS・Azure・GCPなどのプライベートクラウド環境(VPC内)へのデプロイにも対応しています。

これにより、機密情報や顧客データが外部ネットワークに出ることを完全に防ぎ、最高レベルのセキュリティとコンプライアンスを確保した状態でAIを活用できます。

完全閉域網でのAI運用

対応インフラ

オンプレミス

自社サーバー・データセンター

AWS

EC2 / SageMaker / VPC

Microsoft Azure

Azure VM / Azure ML / VNet

Google Cloud

GCE / Vertex AI / VPC

※ いずれの環境でもプライベートネットワーク内にLLMをデプロイし、外部からのアクセスを遮断した状態で運用します。

対応モデル

オープンソースとして公開されている最高峰のモデルから、用途・予算・必要GPU要件に合わせて最適なものを選択・提案します。

Llama 3

Meta

Meta社が開発したオープンソースLLMの代表格。8B〜405Bまで幅広いサイズを展開し、汎用的なタスクで業界トップクラスの性能を発揮します。

文章生成コード補助要約汎用

Gemma

Google

Google DeepMindが開発した高効率モデル。2B〜27Bのコンパクトなサイズながら、同クラスで最高レベルの性能を実現。軽量GPUでも動作可能です。

軽量推論高速低コストエッジ対応

Mistral / Mixtral

Mistral AI

フランス発のAI企業が開発。MoE(Mixture of Experts)アーキテクチャにより、パラメータ数に対して非常に高い推論性能を実現します。

高コスパ推論特化コード生成多言語

Qwen

Alibaba

Alibaba Cloudが開発。日本語・中国語を含むアジア言語に特に強く、0.5B〜110Bまで細かなサイズ展開で用途に応じた選択が可能です。

日本語対応◎多言語サイズ豊富マルチモーダル

モデル別概算料金

同時利用人数:
モデルサイズ日本語必要GPUAWS 月額目安Azure 月額目安
Gemma 2B2B○T4 x1¥50,000〜¥55,000〜
Mistral 7B7B○A10G x1¥120,000〜¥130,000〜
Llama 3 8B8B○A10G x1¥130,000〜¥140,000〜
Qwen 72B72B◎A100 x2¥600,000〜¥650,000〜
Llama 3 405B405B○H100 x8¥3,500,000〜¥3,800,000〜

※ 2026年3月時点でのインフラ費用(GPUインスタンス使用料)を含む概算月額です。実際の料金は構成・利用状況により変動します。詳細はお問い合わせください。

※ 上記に加え、初期構築費用・カスタマイズ費用・サポート費用が別途発生します。

カスタマイズ対応

RAG(検索拡張生成)連携

社内の規定集、マニュアル、過去の提案書などのドキュメントをベクトルデータベース化し、LLMと連携。社内知識に基づいた正確な回答を生成するシステムを構築します。

ファインチューニング

特定の業務ドメインや専門用語、自社特有の言い回しをモデルに追加学習(ファインチューニング)させることで、より業務に特化した高精度なAIモデルを構築します。

導入フロー

1

ヒアリング・要件定義

解決したい課題、必要なセキュリティ要件、想定される利用人数などをヒアリングし、最適な構成を定義します。

2

環境設計・ハードウェア選定

要件に基づき、必要なGPUスペックやサーバー構成を設計します。既存環境の活用や新規調達のサポートも行います。

3

構築・テスト

指定の環境にLLMをデプロイし、RAGなどのカスタマイズ機能を実装します。セキュリティテストと動作検証を徹底して行います。

4

運用開始・サポート

社内ユーザー向けの利用マニュアルを提供し、運用を開始します。モデルのアップデートやトラブルシューティングなど、継続的にサポートします。

貴社に最適なプランをご提案します

お問い合わせはこちら