カスタムLLM
カスタムLLM:お持ちの AIモデルとAPIキーを利用。
OpenAI、Anthropic、Google、Azure、AWS、OpenRouter、xAI、DeepSeek、Groq、Cohere、Ollama、または独自のモデルAPIを持ち込めます。コスト、レイテンシー、機能でリクエストを振り分け、フォールバック、モニタリング、ガバナンスも標準で備えています。
-
OpenAI
-
Anthropic
-
Google Gemini
-
Azure OpenAI
-
AWS Bedrock
-
OpenRouter
-
xAI
-
DeepSeek
-
Groq
-
Cohere
-
Ollama
柔軟なモデル連携
プロバイダー、ルーティング、ガバナンスなど、お使いのスタックに合う方法を選べます。
-
外部APIを接続
認証情報を使って既存のモデルプロバイダーをMonoChatに取り込み、接続を検証します。
- APIキー管理
- 安全な認証情報の保管
- 接続の検証
- 利用状況のモニタリング
-
モデルレジストリ
ワークスペースごとに複数のモデルを管理し、チャネル、担当者、スコープに割り当てます。
- プロバイダー+モデルカタログ
- ワークスペースごとの分離
- 環境の分離
- バージョン管理された設定
-
ルーティングとフォールバック
コスト、レイテンシー、機能、言語で振り分けます。安全なフォールバックとA/Bテストにも対応します。
- インテリジェントなルーティングルール
- フォールバックチェーン
- A/Bテスト
- パフォーマンス比較
対応APIプロバイダー
特定のベンダーに縛られず、お好みのプロバイダーを接続できます。
-
OpenAI
アシスタント、検索、コンテンツ生成向けの、汎用の言語・画像・音声モデルファミリーです。
- チャット・アシスタントモデル
- マルチモーダル推論モデル
- 埋め込みとツール
-
Anthropic
エンタープライズ級の会話に向けた、安全性重視のアシスタント・推論モデルファミリーです。
- アシスタント型モデル
- 長いコンテキストに対応した推論モデル
- エンタープライズ向け安全性ツール
-
Google
検索、会話、マルチモーダル体験向けのGoogle AIモデルファミリーです。
- 検索・会話モデル
- マルチモーダルモデル
- エンタープライズ向けMLサービス
-
Azure OpenAI
Azureのコンプライアンス、可観測性、ガバナンスを備えたエンタープライズ向けOpenAIサービスです。
- マネージド基盤モデル
- エンタープライズのセキュリティとコンプライアンス
- モニタリングと可観測性
-
AWS Bedrock
AWS上のフルマネージド基盤モデルを、お客様自身のクラウドアカウントとリージョン内で実行します。
- 複数のモデルファミリー
- お客様のAWSアカウント内で実行
- IAMとVPCの統合
-
OpenRouter
多数のプロバイダーの数百のモデルを1つのAPIキーで利用でき、請求の一本化と自動のプロバイダーフォールバックにも対応します。
- 1つのAPIで数百のモデルを利用
- オープンソースとプロプライエタリのモデル
- プロバイダーフォールバックと価格ルーティング
-
xAI
高速でリアルタイム性に優れた会話と推論のための、Grokモデルファミリーです。
- Grokチャットモデル
- 推論モデル
- 画像対応
-
DeepSeek
コスト効率が高く、コーディングと数学に強いチャット・推論モデルです。
- チャットモデル
- 推論モデル
- トークンあたりの低コスト
-
Groq
人気のオープンモデルを超低レイテンシーで推論でき、リアルタイムチャットに最適です。
- 非常に高速な推論
- オープンソースモデル
- リアルタイムの会話
-
Cohere
検索拡張、検索、多言語のビジネス利用向けに作られた、エンタープライズ向け言語モデルです。
- Commandチャットモデル
- 埋め込みとリランク
- 多言語対応
-
Ollama
オープンソースモデルを自社サーバーで実行し、すべての会話を自社のインフラ内に保持します。
- セルフホスト型モデル
- データはオンプレミスに保持
- トークン単位の料金なし
-
カスタムAPI
社内開発または特定分野向けの独自モデルAPIを、チームが完全に管理できます。
- 社内モデルゲートウェイ
- 分野特化型モデル
- プライベート推論エンドポイント
簡単な連携プロセス
カスタムモデルを、わかりやすく再現しやすい設定で稼働させます。
-
API認証情報を追加
プロバイダーのキーを安全に追加し、ロールごとにアクセスを制限します。
-
ルーティングを設定
チャネル、担当者、ワークフローごとに、モデルの優先順位、フォールバック、ルールを設定します。
-
テストとデプロイ
テストを実行し、パフォーマンスをモニタリングして、安全に本番へ展開します。
エンタープライズ級のセキュリティ
すべてのモデルとワークスペースで、認証情報を保護しガバナンスを徹底します。
-
認証情報の暗号化
すべてのプロバイダー認証情報は、保存時も通信時も暗号化されます。
-
アクセス制御
ロールベースのアクセス制御(RBAC)による、きめ細かな権限設定です。
-
監査ログ
モデル設定の変更と利用状況の完全な監査証跡を残します。
-
ワークスペースの分離
データとモデル設定は、ワークスペースごとに分離されます。
業界特化型モデル
チームがMonoChatに接続している、分野特化型モデル構成の例です。
-
EC
- 商品レコメンドエンジン
- 顧客の感情分析
- 価格最適化モデル
- 在庫予測
-
ヘルスケア
- 医療問診アシスタント
- 患者トリアージシステム
- 薬の相互作用チェッカー
- 症状分析
-
金融
- 不正検知システム
- 与信スコアリングモデル
- リスク評価ツール
- コンプライアンス要約
-
教育
- 個別最適化された学習パス
- 生徒の成績予測
- コンテンツレコメンド
- 自動採点
よくある質問
カスタムLLMに関するよくある質問
よくあるご質問にすばやくお答えします。
MonoChatにおける「独自LLMの持ち込み」とは何ですか?
すでにご利用中のモデルプロバイダーのAPI認証情報を接続します。MonoChatはお客様のアカウント経由でモデルを呼び出すため、料金やデータに関する契約はそのまま維持され、AIの上乗せ料金はありません。
どのLLMプロバイダーを接続できますか?
OpenAI、Anthropic、Google、Azure OpenAI、AWS Bedrock、OpenRouter、xAI、DeepSeek、Groq、Cohere、Ollamaに加え、独自のカスタムモデルAPIも利用できます。
アシスタントやチャネルごとに異なるモデルを使えますか?
はい。モデルレジストリで、ワークスペースごとに複数のモデルを管理し、チャネル、担当者、スコープに割り当てられます。ルーティングルールでは、コスト、レイテンシー、機能、言語に基づいてモデルを選択でき、プロバイダーに障害が発生した場合のフォールバックチェーンも設定できます。
セルフホスト型やプライベートなモデルは使えますか?
はい。Ollamaを使って自社サーバーでオープンソースモデルを実行したり、カスタムAPIエンドポイント経由で自社開発のモデルを接続したりできます。
プロバイダーのAPIキーはどのように保護されますか?
プロバイダーの認証情報は、保存時も通信時も暗号化されます。ロールベースのアクセス制御で利用できるユーザーを制限し、変更は監査ログに記録され、モデル設定はワークスペースごとに分離されます。
Growthプランの初月無料
モデルを接続する準備はできましたか?
認証情報を追加し、ルーティングを設定して、MonoChatでマルチモデルのアシスタントを運用します。ガバナンスとモニタリングにも対応しています。
1ビジネスにつき1コード • 有効期間30日 • カード不要