M

marlin

@IST-DASLab

FP16xINT4 LLM inference kernel that can achieve near-ideal ~4x speedups up to medium batchsizes of 16-32 tokens.

Apache-2.0 Commit 2 jaaren geleden ★ 1.152

Pijlers en weging

Soevereiniteit 30% 53
Onderhoud 25% 0
Beveiliging 20% geen gegevens
Adoptie 15% 29
Open standaarden 10% 0

Waarom deze score

  • Apache-2.0 (permissief)
  • Laatste commit 753 dagen geleden
  • Top 71% naar sterren in Developer Tools › Operating Systems and Kernels

Feiten

Licentie
Apache-2.0 (Permissief)
Taal
Python
GitHub-sterren
1.152
Laatste commit
2024-09-04 (2 jaaren geleden)
Laatste release
Onbekend
OpenSSF Scorecard
Nog niet gemeten
Zelf hosten
Niet vastgesteld
Maintainer-locatie
Onbekend
Bron
github-crawl