Propietario
ashhart
1 repositorio indexado · Ver en GitHub
-
TensorFold
Fast, exact LLM decoding on Apple Silicon (MLX) behind an OpenAI-compatible endpoint
Python · 995 estrellas
Las issues en las que quizá ya trabaja alguien aparecen al final. Ordenar todo por fecha
-
Dificultad 3/5 1-2 días Aptitud para principiantes 62/100
ashhart/TensorFold#538 ·
Los mantenedores suelen responder en 1 día
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 35/100
ashhart/TensorFold#537 ·
Los mantenedores suelen responder en 1 día
-
Qwen3.5 native decode on the 27B: what bounds the projection kernel, and the FP32 family (parked)Abierto
Dificultad 5/5 Más de una semana Aptitud para principiantes 8/100
ashhart/TensorFold#527 · 4 comentarios ·
Los mantenedores suelen responder en 1 día
-
Proposal: an Intel GPU (Level Zero) backend, starting with Nemotron 3.5 Lightning on Intel ArcAbierto
Dificultad 5/5 Más de una semana Aptitud para principiantes 8/100
ashhart/TensorFold#522 ·
Los mantenedores suelen responder en 1 día
-
Dificultad 4/5 3-5 días Aptitud para principiantes 22/100
ashhart/TensorFold#512 ·
Los mantenedores suelen responder en 1 día
-
Dificultad 4/5 3-5 días Aptitud para principiantes 42/100
ashhart/TensorFold#511 · 1 comentario ·
Los mantenedores suelen responder en 1 día
-
Dificultad 4/5 3-5 días Aptitud para principiantes 48/100
ashhart/TensorFold#510 ·
Los mantenedores suelen responder en 1 día
-
--learn: no free-disk floor, so a full disk makes each new session retry a full learned-state writeAbierto
Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100
ashhart/TensorFold#508 ·
Los mantenedores suelen responder en 1 día
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100
ashhart/TensorFold#505 ·
Los mantenedores suelen responder en 1 día
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100
ashhart/TensorFold#504 ·
Los mantenedores suelen responder en 1 día
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100
ashhart/TensorFold#503 ·
Los mantenedores suelen responder en 1 día
-
Dificultad 3/5 1-2 días Aptitud para principiantes 68/100
ashhart/TensorFold#498 · 1 comentario ·
Los mantenedores suelen responder en 1 día
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100
ashhart/TensorFold#494 ·
Los mantenedores suelen responder en 1 día
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100
ashhart/TensorFold#491 · 1 comentario · 1 reacción ·
Los mantenedores suelen responder en 1 día
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 1/100
ashhart/TensorFold#481 ·
Los mantenedores suelen responder en 1 día
-
Dificultad 1/5 Menos de una hora Aptitud para principiantes 35/100
ashhart/TensorFold#479 · 1 comentario ·
Los mantenedores suelen responder en 1 día
-
Dense NVIDIA Qwen3.8 NVFP4 native vision: tested Python 0.6.0 compatibility patch and reproducerAbierto
Dificultad 5/5 Más de una semana Aptitud para principiantes 35/100
ashhart/TensorFold#474 · 1 comentario ·
Los mantenedores suelen responder en 1 día
-
Xcode Claude Code support breaksAbierto
Dificultad 3/5 1-2 días Aptitud para principiantes 64/100
ashhart/TensorFold#471 ·
Los mantenedores suelen responder en 1 día
-
Dificultad 3/5 1-2 días Aptitud para principiantes 68/100
ashhart/TensorFold#470 ·
Los mantenedores suelen responder en 1 día
-
Dificultad 4/5 3-5 días Aptitud para principiantes 52/100
ashhart/TensorFold#459 · 1 comentario ·
Los mantenedores suelen responder en 1 día
-
Dificultad 4/5 3-5 días Aptitud para principiantes 35/100
ashhart/TensorFold#457 · 1 comentario ·
Los mantenedores suelen responder en 1 día
-
Dificultad 4/5 3-5 días Aptitud para principiantes 62/100
ashhart/TensorFold#456 · 1 comentario ·
Los mantenedores suelen responder en 1 día
-
Dificultad 4/5 3-5 días Aptitud para principiantes 55/100
ashhart/TensorFold#451 · 1 comentario ·
Los mantenedores suelen responder en 1 día
-
Dificultad 3/5 1-2 días Aptitud para principiantes 66/100
ashhart/TensorFold#449 · 2 comentarios ·
Los mantenedores suelen responder en 1 día
-
CUDA Flash Next: rope scaling (YaRN) beyond the native 262,144 tokens — input for the Zig serverAbierto
Dificultad 4/5 3-5 días Aptitud para principiantes 32/100
ashhart/TensorFold#448 · 2 comentarios ·
Los mantenedores suelen responder en 1 día
-
Dificultad 4/5 3-5 días Aptitud para principiantes 38/100
ashhart/TensorFold#447 · 2 comentarios ·
Los mantenedores suelen responder en 1 día
-
Dificultad 4/5 3-5 días Aptitud para principiantes 32/100
ashhart/TensorFold#444 · 8 comentarios ·
Los mantenedores suelen responder en 1 día
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 30/100
ashhart/TensorFold#442 · 2 comentarios ·
Los mantenedores suelen responder en 1 día
-
Kolibri 1 (MLX): shared multi-stream forwards are not bit-exact, so streams take turnsQuizá libre de nuevo Un pull request para esta issue se cerró sin fusionarse. Abierto
Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100
ashhart/TensorFold#434 · 3 comentarios ·
Los mantenedores suelen responder en 1 día
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100
ashhart/TensorFold#428 · 3 comentarios ·
Los mantenedores suelen responder en 1 día
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100
ashhart/TensorFold#426 · 10 comentarios · 1 reacción ·
Los mantenedores suelen responder en 1 día
-
GLM CUDA engine: `_take_over` clones every kept snapshot it is about to drop, so reserved memory spikes by about 15 GiB per rank when a new conversation follows a long oneQuizá libre de nuevo Un pull request para esta issue se cerró sin fusionarse. Abierto
Dificultad 4/5 3-5 días Aptitud para principiantes 25/100
ashhart/TensorFold#420 · 2 comentarios ·
Los mantenedores suelen responder en 1 día
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 30/100
ashhart/TensorFold#417 · 2 comentarios ·
Los mantenedores suelen responder en 1 día
-
Dificultad 4/5 3-5 días Aptitud para principiantes 45/100
ashhart/TensorFold#414 · 4 comentarios ·
Los mantenedores suelen responder en 1 día
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100
ashhart/TensorFold#412 · 6 comentarios ·
Los mantenedores suelen responder en 1 día
-
Proposal: optional Mojo kernels for the ROCm decode path (R9700: 6.6–10.5% faster decode, same bits)Abierto
Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100
ashhart/TensorFold#406 · 4 comentarios ·
Los mantenedores suelen responder en 1 día
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100
ashhart/TensorFold#402 · 2 comentarios ·
Los mantenedores suelen responder en 1 día
-
CUDA glm5_next (TP / --parallel): kept prompt states never use the conversation spill tier (--spill-gib / --snapshot-dir are MLX-only and silently ignored)Quizá libre de nuevo Un pull request para esta issue se cerró sin fusionarse. Abierto
Dificultad 5/5 Más de una semana Aptitud para principiantes 30/100
ashhart/TensorFold#373 · 3 comentarios ·
Los mantenedores suelen responder en 1 día
-
Dificultad 4/5 3-5 días Aptitud para principiantes 54/100
ashhart/TensorFold#368 · 6 comentarios ·
Los mantenedores suelen responder en 1 día
-
feat(vision): enable --vision for qwen3_5_moe (Qwen3.6-35B-A3B) on CUDAQuizá libre de nuevo Un pull request para esta issue se cerró sin fusionarse. Abierto
Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100
ashhart/TensorFold#366 · 2 comentarios ·
Los mantenedores suelen responder en 1 día
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100
ashhart/TensorFold#339 · 2 comentarios ·
Los mantenedores suelen responder en 1 día
-
Flash Next CUDA `--parallel`: a growing conversation recaptures the lone-stream graphs at every context bucket and slot resize (single-stream decode −25…−60 % on those turns)Quizá libre de nuevo Un pull request para esta issue se cerró sin fusionarse. Abierto
Dificultad 5/5 Más de una semana Aptitud para principiantes 35/100
ashhart/TensorFold#336 · 2 comentarios ·
Los mantenedores suelen responder en 1 día
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100
ashhart/TensorFold#322 · 1 comentario ·
Los mantenedores suelen responder en 1 día
-
CUDA: may the bf16 head (b16) decode on the mma for K % 64 == 0? It changes the head's sum orderAbierto
Dificultad 4/5 3-5 días Aptitud para principiantes 35/100
ashhart/TensorFold#321 · 2 comentarios ·
Los mantenedores suelen responder en 1 día
-
Flash Next (MLX 4-bit + MTP) on a single DGX Spark: v0.6.4 decodes ~24% slower than v0.6.3, with a single streamQuizá libre de nuevo Un pull request para esta issue se cerró sin fusionarse. Abierto
Dificultad 4/5 3-5 días Aptitud para principiantes 35/100
ashhart/TensorFold#317 · 13 comentarios ·
Los mantenedores suelen responder en 1 día
-
Dificultad 4/5 3-5 días Aptitud para principiantes 48/100
ashhart/TensorFold#314 · 1 comentario ·
Los mantenedores suelen responder en 1 día
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 20/100
ashhart/TensorFold#313 · 1 comentario ·
Los mantenedores suelen responder en 1 día
-
Laguna-S-2.1 (poolside) on Macs: a `laguna` family with DFlash drafts?Quizá libre de nuevo Un pull request para esta issue se cerró sin fusionarse. Abierto
Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100
ashhart/TensorFold#312 · 1 comentario ·
Los mantenedores suelen responder en 1 día
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 35/100
ashhart/TensorFold#311 · 1 comentario · 2 reacciones ·
Los mantenedores suelen responder en 1 día
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100
ashhart/TensorFold#310 · 5 comentarios ·
Los mantenedores suelen responder en 1 día