事業内容

事業内容 AIインフラストラクチャLLM・トークン基盤AIソリューション

会社概要

技術と体制 導入事例 ニュース 会社概要 採用情報 お問い合わせ

ニュース

ニュース

プレスリリース、技術情報、コーポレート情報を掲載しています。

2026-07-28

コーポレート

運用受託中のGPUが400枚を超えました

2024年5月の設立以来、お客様よりお預かりし運用しているGPUの総数が400枚を超えました。引き続き、提携データセンターとの体制を拡充してまいります。

2026-06-17

技術情報

推論基盤における投機的デコーディング適用の実測結果を公開

70B級モデルを対象に、ドラフトモデルを併用した投機的デコーディングを適用し、出力トークン単価とp95レイテンシへの影響を測定しました。条件により p95 で 31〜44% の改善を確認しています。

2026-05-20

プレスリリース

LLMゲートウェイに部門別チャージバック機能を追加

リクエスト単位で部門・用途・モデルを記録し、月次の課金按分資料を自動生成する機能を追加しました。既存のお客様は追加費用なくご利用いただけます。

2026-04-08

技術情報

高密度ラックにおける直接液冷導入の検証結果について

提携データセンターの協力を得て、1ラックあたり60kW超の構成において直接液冷(DLC)を導入した場合のPUEおよびGPU温度分布を検証しました。空冷構成との比較データを技術資料として公開しています。

2026-03-02

コーポレート

AIソリューションチームを新設しました

RAG基盤および業務AIエージェントの開発体制を拡充するため、AIソリューションチームを新設し、専任のソリューションアーキテクトを配置しました。

2026-01-22

プレスリリース

金融サービス事業者向けプライベート推論環境が本格稼働

2025年12月に構築したプライベート推論環境が、お客様グループ会社の全部門向け基盤として本格稼働を開始しました。利用部門は導入時の3部門から11部門に広がっています。

2025-11-11

技術情報

Slurm と Kubernetes の混在環境における GPU 割当設計について

学習ジョブと推論ワークロードが同一クラスタを共有する構成において、優先度制御とプリエンプションをどう設計したかを技術資料として公開しました。

2025-08-05

プレスリリース

推論最適化サービスの提供を開始しました

vLLM および TensorRT-LLM を対象に、スループット・レイテンシ・トークン単価の改善を受託するサービスの提供を開始しました。既存構成のアセスメントのみのご依頼も承ります。

まだ何も決まっていない段階で、呼んでください。

「GPUは何枚必要か」「持つべきか、借りるべきか」。いちばん多いのは、この段階のご相談です。要件が固まっていなくて構いません。

お問い合わせはこちら