Wafer
Summer 2025活動中AIを高速化するAI
- サマリー
- Open source LLMの推論向けに、高速なserverless専用推論を提供する
- 課題
- AI推論では、GPU kernelの最適化が必要で高速化が難しい
- 解決策
- 自律型performance engineerがGPU kernelを最適化し、推論を高速化する
AI による要約
- 所在地
- San Francisco, CA, USA
- チーム規模
- 7 人
事業内容
Waferは、自律型のパフォーマンスエンジニアとして機能し、AI推論向けにGPUカーネルを最適化するAIエージェントを構築する。 製品は、世界最速クラスのオープンソースLLM向けに、サーバーレスかつ専用の推論環境を提供する。Waferの自律型パフォーマンスエンジニアが最適化を実現する。