← 一覧に戻る

Wafer

Summer 2025活動中

AIを高速化するAI

サマリー
Open source LLMの推論向けに、高速なserverless専用推論を提供する
課題
AI推論では、GPU kernelの最適化が必要で高速化が難しい
解決策
自律型performance engineerがGPU kernelを最適化し、推論を高速化する

AI による要約

業種
B2Bエンジニアリング・プロダクト・デザイン
所在地
San Francisco, CA, USA
チーム規模
7

事業内容

Waferは、自律型のパフォーマンスエンジニアとして機能し、AI推論向けにGPUカーネルを最適化するAIエージェントを構築する。 製品は、世界最速クラスのオープンソースLLM向けに、サーバーレスかつ専用の推論環境を提供する。Waferの自律型パフォーマンスエンジニアが最適化を実現する。

公式サイト ↗YC のページ ↗