ジムレットとセラブレアス、超高速AI推論クラウドを提供
Gimlet LabsとCerebras Systemsは9月28日、超高速AI推論を大規模展開するための戦略的協業を発表した。同連携により、CerebrasのウェーハースケールエンジンとGimlet Cloudのマルチシリコン推論アーキテクチャを統合し、本番環境で最大3,000トークン毎秒の推論速度を実現する。第一弾データセンターは2026年内に稼働予定だ。 両社は、音声・ビデオAIや自律型エージェントなどリアルタイムアプリケーションにおいて、推論レイテンシがユーザー体験と開発可能性を分けると指摘する。Gimlet Cloudは推論処理を細分化し、各フェーズを最適なハードウェアで実行する高度な推論ディセンタリゼーション技術を採用している。Cerebrasの高速推論能力とGPUの高スループット特性を組み合わせることで、データセンター全体の計算コスト効率を最適化し、開発者向け生産環境へのアクセスを拡大する方針だ。 Gimlet LabsCEOのザイン・アスガル氏は、高速推論がAIの生産性と新市場開拓の要であると強調。CerebrasCTOのショーン・リー氏は、両社の技術統合が業界最高の推論速度と高いスループットを両立させ、CS-4プラットフォームのローンチパートナーとして最新技術を大規模展開できると述べた。 今後はソフトウェア統合、インフラ設計、API公開、デベロッパーツール整備、最適化検証から本番運用までを含むよう連携を深化させる。昨年からの共同顧客検証やプライベートデプロイメントで蓄積した知見を基盤に、超高速推論インフラを広く一般公開する計画だ。Gimlet Labsはサンフランシスコを拠点にベンチャーキャピタルから支援を受け、Cerebrasはナスダック上場企業として世界最速AIインフラの標準化を推進する。本協業はリアルタイムAI需要の拡大に伴う次世代推論環境の基盤整備に寄与すると見られる。
