HyperAIHyperAI

Command Palette

Search for a command to run...

플래시모바

날짜

조직

Massachusetts Institute of Technology
NVIDIA

Paper URL

2511.11571

FlashMoBA는 2025년 11월 MIT와 엔비디아 연구팀이 공동으로 제안했으며, 관련 연구 결과는 논문으로 발표되었습니다. 블록 어텐션의 혼합 최적화 .

FlashMoBA는 하드웨어 인식 CUDA 커널로, 이론적으로 권장되는 작은 블록 크기에서도 효율적인 MoBA 실행을 가능하게 합니다. FlashAttention의 기술을 차용하고 블록 희소성을 위한 새로운 최적화 기법을 추가하여, FlashAttention-2 대비 14.7배의 속도 향상을 달성함으로써, 이전에는 실현 불가능했지만 이론적으로 최적의 구성을 구현할 수 있게 되었습니다.

AI로 AI 구축

아이디어에서 출시까지 — 무료 AI 코코딩, 즉시 사용 가능한 환경, 최적의 GPU 가격으로 AI 개발을 가속화하세요.

AI 협업 코딩
바로 사용 가능한 GPU
최적의 가격

HyperAI Newsletters

최신 정보 구독하기
한국 시간 매주 월요일 오전 9시 에 이번 주의 최신 업데이트를 메일로 발송합니다
이메일 서비스 제공: MailChimp