AIシステム開発・導入事例

AIシステム。
ソフトウェアとハードウェアを、まとめてお届け。

AI宿泊予約、AIカスタマーサポート、AI ERP。設計から開発、導入まで、すべてMAQが担当します。AIサーバーの構築が必要な場合も、MAQが一括してお届けします。

MAQが納入したオンプレミスAIサーバー・NVIDIA RTX PRO 6000 Blackwell 96GB
8
民宿が1つのシステムを共用
24時間
深夜の問い合わせにも対応
161tok/s
実機での計測値
0
会話データはサーバー外へ送信されません
What we build

3つのシステム。すべて稼働中です。

予約システムと連携することで、AIは実際の空室状況を把握できます。

AI宿泊予約

予約システムと料金カレンダーに接続。空室確認、料金計算、予約リンクの発行まで対応します。

  • リアルタイムの空室状況。平日・休日料金、追加人数、ペット、朝食ルールにも対応
  • 日付と人数をあらかじめ入力した予約リンクを発行、割引コードにも対応
  • 祝日は自動計算、モデルによる推測は行いません
  • 価格交渉やクレームは有人対応に切り替え、経営者へ即時通知
  • 複数のLINE公式アカウントで同一のルールを共有
稼働中・宜蘭の民宿8軒

AIカスタマーサポート

モデルはお客様自身のマシン上で稼働。回答できる内容はAIが対応し、対応できない場合はスタッフに引き継ぎます。

  • 会話データは自社サーバーに保存、第三者サービスを経由しません
  • ツール呼び出しにより社内データベースとナレッジベースを直接参照
  • 有人対応への切り替え:プッシュ通知、ワンタップ切替で対応漏れなし
  • 公式サイトのチャットウィンドウとLINE公式アカウントの両方に設置可能
  • 口調、権限、返信ルールは管理画面から調整可能
稼働中・MAQ AI相談窓口

AI ERP

在庫管理、購買、受注データを、自然言語でそのまま検索。データは既存システム内に留まります。

  • 顧客、受注、在庫、購買情報を自然言語で検索
  • 既存のデータテーブルに接続、別途データウェアハウスは不要
  • ナレッジベース検索により、新人でもすぐに質問可能
  • 権限を階層化し、機密情報が外部チャネルに流出しない設計
  • 自社サーバーへのオンプレミス一括導入も可能
稼働中・MAQ自社ERP
MAQが納入したオンプレミスAIサーバー構成
Case・宿泊業

Kei Café B&B。
民宿8軒、システムは1つ。

深夜や連休中の問い合わせは、以前は翌日まで待つしかありませんでした。現在はAIが空室確認、料金案内、予約リンクの発行まで即座に対応。価格交渉やクレームは有人対応に切り替えます。

システムは自社サーバー上で稼働。会話データと顧客情報は、社内ネットワーク内に留まります。

予約システム連携 LINE複数アカウント レストラン予約 オンプレミス稼働
実際の稼働を見る ›
What it does

できること。回答するだけではありません。

確認も、計算も、リンクの発行もこなします。そして、いつ人に引き継ぐべきかも判断します。

実際の空室状況を把握。

予約システムと連動し、実際の空室状況を回答。平日・休日料金、追加人数、ペット、朝食も料金カレンダーに基づいて計算します

リンクを開けばすぐ完了。

日付と人数はあらかじめ入力済み、開けばそのまま見積もりページへ。割引コードも自動適用されます

祝日も正しく理解。

端午節や中秋節も正しい日付に自動変換。プログラムが計算するため、モデルが推測することはありません

価格交渉を勝手に判断しません。

ゲストが予算や価格への不満を伝えた場合、まず詳しく確認したうえで経営者に通知。AIが独断で値引きすることはありません

まず安全を確認。

備品の破損報告を受けた場合、まず怪我の有無を確認。弁償については有人対応に引き継ぎます

いつでも有人対応に切替。

「担当者と話したい」と伝えるとプッシュ通知が届き、AIはすぐに応答を止めます。管理画面のワンタップでAI対応に戻すことも可能、対応漏れはありません

8つのアカウント、頭脳は1つ。

各民宿がそれぞれLINE公式アカウントと公式サイトのチャットウィンドウを持ちながら、背後では同一のルールとデータを共有しています

レストランにも対応。

モーニング・ブランチの時間帯を確認し、看板メニューや予約方法もあわせて案内します

Benchmark

パフォーマンス。実機での計測値。

数値はすべて、この稼働中のサーバーで実測したものです。モデルはgpt-oss-120B。

161tok/s
生成速度
人が入力する速度の数倍
3,370tok/s
プリフィル速度
システム設定と会話履歴全体を読み込み
2.6
5人同時に質問
バッチ処理により順番待ちなし
Real workload

応答速度。同時対応数。

1回のやり取りでシステム設定と会話履歴、約10〜12Kトークンを読み込みます。データベース参照の要否はシステムが自動的に判断します。

応答速度
会話の種類実測値補足
施設に関する質問2–4秒データベース参照なし、直接回答
空室確認・料金案内6–10秒ツールを呼び出しリアルタイムの空室を確認
複数施設の比較・貸切10–14秒複数の民宿を一括確認
同時対応数
設定同時会話数体感
標準4名それぞれ通常速度を維持
現行8並列構成8名VRAMにまだ余裕あり
理論上の最大値約600–900セッション/時1セッションあたり3–5往復

// 計測環境:Ollama + gpt-oss-120B、NVIDIA RTX PRO 6000 96GBを1枚使用、社内ネットワーク遅延は約3ms。

Evidence

実証。
まず自分たちで使う。

お客様にご提案するアーキテクチャは、すべて自社の稼働システムで先に検証しています。

自社ERPは、自社で開発。
在庫管理、購買、受注、電子インボイス、原価レポート、勤怠管理まで、すべて自社開発。15年以上にわたり本番環境で稼働しています。企業システムについて語るとき、MAQはベンダーであると同時にユーザーでもあります。
自社のAI相談窓口も、自社のマシンで稼働。
MAQのAI相談窓口は、オンプレミスのAMD Radeon AI PRO R9700ホスト上で稼働し、モデルにはオープンウェイトのGemma 4を使用しています。同じアーキテクチャで、実際のデータと性能を確認済みです。
ソフトウェアとハードウェア、同じチームで。
システム開発、インターフェース設計、モデルの導入、サーバーの構築まで、すべてMAQ社内で完結します。トラブル発生時にソフトウェアベンダーとハードウェアベンダーの間を行き来する必要はありません。
For hospitality

観光産業の皆様へ。お気軽にお問い合わせください。

問い合わせは深夜や連休に集中します。人手による対応が最も難しい時間帯こそ、AIが力を発揮します。業態に応じて同じシステムを調整できます。

民宿ホテル・旅館貸切ヴィラキャンプ場 レストラン観光工場ツアー・チケット複数ブランドのチェーン
1

まず現状を把握。

予約、POS、顧客データがどこにあるか、日々繰り返される質問は何かを確認します。既存システムを入れ替える必要はありません。

2

処理の実行場所を決定。

データの機密性と利用量に応じて、クラウドAPIか自社サーバーかを選択します。多くの場合はクラウドから始め、利用量が増えた段階で自社AIサーバーへ移行します。

3

システム連携とインターフェース構築。

予約システムと料金ルールを接続し、LINEと公式サイトの入口を設定、有人対応へ切り替えるタイミングを定義します。

4

まず1軒から開始。

単一ブランドまたは単一の時間帯から開始。回答品質と成約状況を確認したうえで、全店舗へ展開します。

The machine

AIサーバー。
必要な場合は、あわせてお届け。

クラウドのトークン費用を心配する必要も、データの社外持ち出しを禁じる社内規定に悩む必要もありません。システム全体を自社サーバーへ移行できます。

96GB GPU 1枚で1,200億パラメータのモデルを分割やダウンサンプリングなしで完全に読み込めます。1台の演算能力で、複数ブランドへの同時対応も可能です。

RTX PRO 6000

96GBのVRAMで、1枚のカードに120Bモデルを読み込み

Threadripper PRO

32コアのサーバープラットフォーム、IPMIによるリモート管理に対応

DDR5 ECC

サーバー級のエラー訂正メモリで、長時間の演算も安定

Ubuntu + Ollama

OpenAI互換API、モデルは常にVRAM上に常駐

はじめに、業務フローからご相談ください。

最初のステップは機種選びではなく、どの業務をシステムに任せ、どのデータを社内ネットワークの外に出せないかを決めることです。検討の結果、費用対効果が見合わない場合は、MAQは率直にお伝えします。