メインコンテンツへスキップ

カスタムLLM

カスタムLLM:お持ちの AIモデルとAPIキーを利用。

OpenAI、Anthropic、Google、Azure、AWS、OpenRouter、xAI、DeepSeek、Groq、Cohere、Ollama、または独自のモデルAPIを持ち込めます。コスト、レイテンシー、機能でリクエストを振り分け、フォールバック、モニタリング、ガバナンスも標準で備えています。

または150ドル分のクレジットで始めましょう。Growthの初月分に相当します

  • OpenAI
  • Anthropic
  • Google Gemini
  • Azure OpenAI
  • AWS Bedrock
  • OpenRouter
  • xAI
  • DeepSeek
  • Groq
  • Cohere
  • Ollama

柔軟なモデル連携

プロバイダー、ルーティング、ガバナンスなど、お使いのスタックに合う方法を選べます。

  • 外部APIを接続

    認証情報を使って既存のモデルプロバイダーをMonoChatに取り込み、接続を検証します。

    • APIキー管理
    • 安全な認証情報の保管
    • 接続の検証
    • 利用状況のモニタリング
  • モデルレジストリ

    ワークスペースごとに複数のモデルを管理し、チャネル、担当者、スコープに割り当てます。

    • プロバイダー+モデルカタログ
    • ワークスペースごとの分離
    • 環境の分離
    • バージョン管理された設定
  • ルーティングとフォールバック

    コスト、レイテンシー、機能、言語で振り分けます。安全なフォールバックとA/Bテストにも対応します。

    • インテリジェントなルーティングルール
    • フォールバックチェーン
    • A/Bテスト
    • パフォーマンス比較

対応APIプロバイダー

特定のベンダーに縛られず、お好みのプロバイダーを接続できます。

  • OpenAI

    アシスタント、検索、コンテンツ生成向けの、汎用の言語・画像・音声モデルファミリーです。

    • チャット・アシスタントモデル
    • マルチモーダル推論モデル
    • 埋め込みとツール
  • Anthropic

    エンタープライズ級の会話に向けた、安全性重視のアシスタント・推論モデルファミリーです。

    • アシスタント型モデル
    • 長いコンテキストに対応した推論モデル
    • エンタープライズ向け安全性ツール
  • Google

    検索、会話、マルチモーダル体験向けのGoogle AIモデルファミリーです。

    • 検索・会話モデル
    • マルチモーダルモデル
    • エンタープライズ向けMLサービス
  • Azure OpenAI

    Azureのコンプライアンス、可観測性、ガバナンスを備えたエンタープライズ向けOpenAIサービスです。

    • マネージド基盤モデル
    • エンタープライズのセキュリティとコンプライアンス
    • モニタリングと可観測性
  • AWS Bedrock

    AWS上のフルマネージド基盤モデルを、お客様自身のクラウドアカウントとリージョン内で実行します。

    • 複数のモデルファミリー
    • お客様のAWSアカウント内で実行
    • IAMとVPCの統合
  • OpenRouter

    多数のプロバイダーの数百のモデルを1つのAPIキーで利用でき、請求の一本化と自動のプロバイダーフォールバックにも対応します。

    • 1つのAPIで数百のモデルを利用
    • オープンソースとプロプライエタリのモデル
    • プロバイダーフォールバックと価格ルーティング
  • xAI

    高速でリアルタイム性に優れた会話と推論のための、Grokモデルファミリーです。

    • Grokチャットモデル
    • 推論モデル
    • 画像対応
  • DeepSeek

    コスト効率が高く、コーディングと数学に強いチャット・推論モデルです。

    • チャットモデル
    • 推論モデル
    • トークンあたりの低コスト
  • Groq

    人気のオープンモデルを超低レイテンシーで推論でき、リアルタイムチャットに最適です。

    • 非常に高速な推論
    • オープンソースモデル
    • リアルタイムの会話
  • Cohere

    検索拡張、検索、多言語のビジネス利用向けに作られた、エンタープライズ向け言語モデルです。

    • Commandチャットモデル
    • 埋め込みとリランク
    • 多言語対応
  • Ollama

    オープンソースモデルを自社サーバーで実行し、すべての会話を自社のインフラ内に保持します。

    • セルフホスト型モデル
    • データはオンプレミスに保持
    • トークン単位の料金なし
  • カスタムAPI

    社内開発または特定分野向けの独自モデルAPIを、チームが完全に管理できます。

    • 社内モデルゲートウェイ
    • 分野特化型モデル
    • プライベート推論エンドポイント

簡単な連携プロセス

カスタムモデルを、わかりやすく再現しやすい設定で稼働させます。

  1. API認証情報を追加

    プロバイダーのキーを安全に追加し、ロールごとにアクセスを制限します。

  2. ルーティングを設定

    チャネル、担当者、ワークフローごとに、モデルの優先順位、フォールバック、ルールを設定します。

  3. テストとデプロイ

    テストを実行し、パフォーマンスをモニタリングして、安全に本番へ展開します。

エンタープライズ級のセキュリティ

すべてのモデルとワークスペースで、認証情報を保護しガバナンスを徹底します。

  • 認証情報の暗号化

    すべてのプロバイダー認証情報は、保存時も通信時も暗号化されます。

  • アクセス制御

    ロールベースのアクセス制御(RBAC)による、きめ細かな権限設定です。

  • 監査ログ

    モデル設定の変更と利用状況の完全な監査証跡を残します。

  • ワークスペースの分離

    データとモデル設定は、ワークスペースごとに分離されます。

業界特化型モデル

チームがMonoChatに接続している、分野特化型モデル構成の例です。

  • EC

    • 商品レコメンドエンジン
    • 顧客の感情分析
    • 価格最適化モデル
    • 在庫予測
  • ヘルスケア

    • 医療問診アシスタント
    • 患者トリアージシステム
    • 薬の相互作用チェッカー
    • 症状分析
  • 金融

    • 不正検知システム
    • 与信スコアリングモデル
    • リスク評価ツール
    • コンプライアンス要約
  • 教育

    • 個別最適化された学習パス
    • 生徒の成績予測
    • コンテンツレコメンド
    • 自動採点

よくある質問

カスタムLLMに関するよくある質問

よくあるご質問にすばやくお答えします。

MonoChatにおける「独自LLMの持ち込み」とは何ですか?

すでにご利用中のモデルプロバイダーのAPI認証情報を接続します。MonoChatはお客様のアカウント経由でモデルを呼び出すため、料金やデータに関する契約はそのまま維持され、AIの上乗せ料金はありません。

どのLLMプロバイダーを接続できますか?

OpenAI、Anthropic、Google、Azure OpenAI、AWS Bedrock、OpenRouter、xAI、DeepSeek、Groq、Cohere、Ollamaに加え、独自のカスタムモデルAPIも利用できます。

アシスタントやチャネルごとに異なるモデルを使えますか?

はい。モデルレジストリで、ワークスペースごとに複数のモデルを管理し、チャネル、担当者、スコープに割り当てられます。ルーティングルールでは、コスト、レイテンシー、機能、言語に基づいてモデルを選択でき、プロバイダーに障害が発生した場合のフォールバックチェーンも設定できます。

セルフホスト型やプライベートなモデルは使えますか?

はい。Ollamaを使って自社サーバーでオープンソースモデルを実行したり、カスタムAPIエンドポイント経由で自社開発のモデルを接続したりできます。

プロバイダーのAPIキーはどのように保護されますか?

プロバイダーの認証情報は、保存時も通信時も暗号化されます。ロールベースのアクセス制御で利用できるユーザーを制限し、変更は監査ログに記録され、モデル設定はワークスペースごとに分離されます。

Growthプランの初月無料

モデルを接続する準備はできましたか?

認証情報を追加し、ルーティングを設定して、MonoChatでマルチモデルのアシスタントを運用します。ガバナンスとモニタリングにも対応しています。

1ビジネスにつき1コード • 有効期間30日 • カード不要

$150で始められます。

受け取る