Open Issues Need Help
View All on GitHubEmbedding & KV-cache compression for LLMs and vector databases. PCA-Matryoshka + TurboQuant: 27x compression at 99.8% recall@10 (identical reranking). Larger-than-RAM sharded/memmap search, tqp CLI with distribution-free rank certificates, asymmetric K/V, CUDA+Triton kernels, auto-config. 919 tests. MIT.
Embedding & KV-cache compression for LLMs and vector databases. PCA-Matryoshka + TurboQuant: 27x compression at 99.8% recall@10 (identical reranking). Larger-than-RAM sharded/memmap search, tqp CLI with distribution-free rank certificates, asymmetric K/V, CUDA+Triton kernels, auto-config. 919 tests. MIT.
Embedding & KV-cache compression for LLMs and vector databases. PCA-Matryoshka + TurboQuant: 27x compression at 99.8% recall@10 (identical reranking). Larger-than-RAM sharded/memmap search, tqp CLI with distribution-free rank certificates, asymmetric K/V, CUDA+Triton kernels, auto-config. 919 tests. MIT.
Embedding & KV-cache compression for LLMs and vector databases. PCA-Matryoshka + TurboQuant: 27x compression at 99.8% recall@10 (identical reranking). Larger-than-RAM sharded/memmap search, tqp CLI with distribution-free rank certificates, asymmetric K/V, CUDA+Triton kernels, auto-config. 919 tests. MIT.
Embedding & KV-cache compression for LLMs and vector databases. PCA-Matryoshka + TurboQuant: 27x compression at 99.8% recall@10 (identical reranking). Larger-than-RAM sharded/memmap search, tqp CLI with distribution-free rank certificates, asymmetric K/V, CUDA+Triton kernels, auto-config. 919 tests. MIT.
Embedding & KV-cache compression for LLMs and vector databases. PCA-Matryoshka + TurboQuant: 27x compression at 99.8% recall@10 (identical reranking). Larger-than-RAM sharded/memmap search, tqp CLI with distribution-free rank certificates, asymmetric K/V, CUDA+Triton kernels, auto-config. 919 tests. MIT.
Embedding & KV-cache compression for LLMs and vector databases. PCA-Matryoshka + TurboQuant: 27x compression at 99.8% recall@10 (identical reranking). Larger-than-RAM sharded/memmap search, tqp CLI with distribution-free rank certificates, asymmetric K/V, CUDA+Triton kernels, auto-config. 919 tests. MIT.
Embedding & KV-cache compression for LLMs and vector databases. PCA-Matryoshka + TurboQuant: 27x compression at 99.8% recall@10 (identical reranking). Larger-than-RAM sharded/memmap search, tqp CLI with distribution-free rank certificates, asymmetric K/V, CUDA+Triton kernels, auto-config. 919 tests. MIT.
Embedding & KV-cache compression for LLMs and vector databases. PCA-Matryoshka + TurboQuant: 27x compression at 99.8% recall@10 (identical reranking). Larger-than-RAM sharded/memmap search, tqp CLI with distribution-free rank certificates, asymmetric K/V, CUDA+Triton kernels, auto-config. 919 tests. MIT.
Embedding & KV-cache compression for LLMs and vector databases. PCA-Matryoshka + TurboQuant: 27x compression at 99.8% recall@10 (identical reranking). Larger-than-RAM sharded/memmap search, tqp CLI with distribution-free rank certificates, asymmetric K/V, CUDA+Triton kernels, auto-config. 919 tests. MIT.
Embedding & KV-cache compression for LLMs and vector databases. PCA-Matryoshka + TurboQuant: 27x compression at 99.8% recall@10 (identical reranking). Larger-than-RAM sharded/memmap search, tqp CLI with distribution-free rank certificates, asymmetric K/V, CUDA+Triton kernels, auto-config. 919 tests. MIT.
Embedding & KV-cache compression for LLMs and vector databases. PCA-Matryoshka + TurboQuant: 27x compression at 99.8% recall@10 (identical reranking). Larger-than-RAM sharded/memmap search, tqp CLI with distribution-free rank certificates, asymmetric K/V, CUDA+Triton kernels, auto-config. 919 tests. MIT.
Embedding & KV-cache compression for LLMs and vector databases. PCA-Matryoshka + TurboQuant: 27x compression at 99.8% recall@10 (identical reranking). Larger-than-RAM sharded/memmap search, tqp CLI with distribution-free rank certificates, asymmetric K/V, CUDA+Triton kernels, auto-config. 919 tests. MIT.