Forge
Оптимизация GPU-ядер — 32 агента роя превращают PyTorch в быстрые ядра CUDA/Triton на реальных датацентровых GPU с ускорением до 14 раз.
Документация
Документация недоступна.
Оптимизация GPU-ядер — 32 агента роя превращают PyTorch в быстрые ядра CUDA/Triton на реальных датацентровых GPU с ускорением до 14 раз.
Документация недоступна.