S

SageAttention

@thu-ml

[ICLR2025, ICML2025, NeurIPS2025 Spotlight] Quantized Attention achieves speedup of 2-5x compared to FlashAttention, without losing end-to-end metrics across language, image, and video models.

Apache-2.0 Commit 8 maanden geleden ★ 3.950

Pijlers en weging

Soevereiniteit 30% 48
Onderhoud 25% 68
Beveiliging 20% geen gegevens
Adoptie 15% 65
Open standaarden 10% 0

Waarom deze score

  • Apache-2.0 (permissief)
  • Laatste commit 253 dagen geleden
  • Top 35% naar sterren in AI & ML › Grote taalmodellen

Feiten

Licentie
Apache-2.0 (Permissief)
Taal
Cuda
GitHub-sterren
3.950
Laatste commit
2026-01-17 (8 maanden geleden)
Laatste release
Onbekend
OpenSSF Scorecard
Nog niet gemeten
Zelf hosten
Niet vastgesteld
Maintainer-locatie
Onbekend
Bron
github-crawl