サービス内容
セキュアなローカルLLM環境の構築から、業務に合わせたカスタマイズまで、 お客様のAI活用をトータルでサポートします。
ローカルLLM環境構築
クラウド上のAIサービスを利用せず、自社専用の環境に大規模言語モデル(LLM)を構築します。オンプレミスサーバーはもちろん、AWS・Azure・GCPなどのプライベートクラウド環境(VPC内)へのデプロイにも対応しています。
これにより、機密情報や顧客データが外部ネットワークに出ることを完全に防ぎ、最高レベルのセキュリティとコンプライアンスを確保した状態でAIを活用できます。
完全閉域網でのAI運用
対応インフラ
オンプレミス
自社サーバー・データセンター
AWS
EC2 / SageMaker / VPC
Microsoft Azure
Azure VM / Azure ML / VNet
Google Cloud
GCE / Vertex AI / VPC
※ いずれの環境でもプライベートネットワーク内にLLMをデプロイし、外部からのアクセスを遮断した状態で運用します。
対応モデル
オープンソースとして公開されている最高峰のモデルから、用途・予算・必要GPU要件に合わせて最適なものを選択・提案します。
Llama 3
MetaMeta社が開発したオープンソースLLMの代表格。8B〜405Bまで幅広いサイズを展開し、汎用的なタスクで業界トップクラスの性能を発揮します。
Gemma
GoogleGoogle DeepMindが開発した高効率モデル。2B〜27Bのコンパクトなサイズながら、同クラスで最高レベルの性能を実現。軽量GPUでも動作可能です。
Mistral / Mixtral
Mistral AIフランス発のAI企業が開発。MoE(Mixture of Experts)アーキテクチャにより、パラメータ数に対して非常に高い推論性能を実現します。
Qwen
AlibabaAlibaba Cloudが開発。日本語・中国語を含むアジア言語に特に強く、0.5B〜110Bまで細かなサイズ展開で用途に応じた選択が可能です。
モデル別概算料金
| モデル | サイズ | 日本語 | 必要GPU | AWS 月額目安 | Azure 月額目安 |
|---|---|---|---|---|---|
| Gemma 2B | 2B | ○ | T4 x1 | ¥50,000〜 | ¥55,000〜 |
| Mistral 7B | 7B | ○ | A10G x1 | ¥120,000〜 | ¥130,000〜 |
| Llama 3 8B | 8B | ○ | A10G x1 | ¥130,000〜 | ¥140,000〜 |
| Qwen 72B | 72B | ◎ | A100 x2 | ¥600,000〜 | ¥650,000〜 |
| Llama 3 405B | 405B | ○ | H100 x8 | ¥3,500,000〜 | ¥3,800,000〜 |
※ 2026年3月時点でのインフラ費用(GPUインスタンス使用料)を含む概算月額です。実際の料金は構成・利用状況により変動します。詳細はお問い合わせください。
※ 上記に加え、初期構築費用・カスタマイズ費用・サポート費用が別途発生します。
カスタマイズ対応
RAG(検索拡張生成)連携
社内の規定集、マニュアル、過去の提案書などのドキュメントをベクトルデータベース化し、LLMと連携。社内知識に基づいた正確な回答を生成するシステムを構築します。
ファインチューニング
特定の業務ドメインや専門用語、自社特有の言い回しをモデルに追加学習(ファインチューニング)させることで、より業務に特化した高精度なAIモデルを構築します。
導入フロー
ヒアリング・要件定義
解決したい課題、必要なセキュリティ要件、想定される利用人数などをヒアリングし、最適な構成を定義します。
環境設計・ハードウェア選定
要件に基づき、必要なGPUスペックやサーバー構成を設計します。既存環境の活用や新規調達のサポートも行います。
構築・テスト
指定の環境にLLMをデプロイし、RAGなどのカスタマイズ機能を実装します。セキュリティテストと動作検証を徹底して行います。
運用開始・サポート
社内ユーザー向けの利用マニュアルを提供し、運用を開始します。モデルのアップデートやトラブルシューティングなど、継続的にサポートします。