Chủ sở hữu
ashhart
Đã lập chỉ mục 1 kho mã nguồn · Xem trên GitHub
-
TensorFold
Fast, exact LLM decoding on Apple Silicon (MLX) behind an OpenAI-compatible endpoint
Python · 995 star
Các issue có thể đã có người làm được xếp cuối danh sách. Sắp xếp tất cả theo ngày
-
Độ khó 3/5 1-2 ngày Mức phù hợp với người mới 62/100
ashhart/TensorFold#538 ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 2/5 1-3 giờ Mức phù hợp với người mới 35/100
ashhart/TensorFold#537 ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Qwen3.5 native decode on the 27B: what bounds the projection kernel, and the FP32 family (parked)Đang mở
Độ khó 5/5 Hơn một tuần Mức phù hợp với người mới 8/100
ashhart/TensorFold#527 · 4 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Proposal: an Intel GPU (Level Zero) backend, starting with Nemotron 3.5 Lightning on Intel ArcĐang mở
Độ khó 5/5 Hơn một tuần Mức phù hợp với người mới 8/100
ashhart/TensorFold#522 ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 4/5 3-5 ngày Mức phù hợp với người mới 22/100
ashhart/TensorFold#512 ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 4/5 3-5 ngày Mức phù hợp với người mới 42/100
ashhart/TensorFold#511 · 1 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 4/5 3-5 ngày Mức phù hợp với người mới 48/100
ashhart/TensorFold#510 ·
Maintainer thường phản hồi trong vòng 1 ngày
-
--learn: no free-disk floor, so a full disk makes each new session retry a full learned-state writeĐang mở
Độ khó 5/5 Hơn một tuần Mức phù hợp với người mới 25/100
ashhart/TensorFold#508 ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 5/5 Hơn một tuần Mức phù hợp với người mới 25/100
ashhart/TensorFold#505 ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 5/5 Hơn một tuần Mức phù hợp với người mới 25/100
ashhart/TensorFold#504 ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 5/5 Hơn một tuần Mức phù hợp với người mới 25/100
ashhart/TensorFold#503 ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 3/5 1-2 ngày Mức phù hợp với người mới 68/100
ashhart/TensorFold#498 · 1 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 5/5 Hơn một tuần Mức phù hợp với người mới 25/100
ashhart/TensorFold#494 ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 5/5 Hơn một tuần Mức phù hợp với người mới 25/100
ashhart/TensorFold#491 · 1 bình luận · 1 reaction ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 5/5 Hơn một tuần Mức phù hợp với người mới 1/100
ashhart/TensorFold#481 ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 1/5 Dưới một giờ Mức phù hợp với người mới 35/100
ashhart/TensorFold#479 · 1 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Dense NVIDIA Qwen3.8 NVFP4 native vision: tested Python 0.6.0 compatibility patch and reproducerĐang mở
Độ khó 5/5 Hơn một tuần Mức phù hợp với người mới 35/100
ashhart/TensorFold#474 · 1 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Xcode Claude Code support breaksĐang mở
Độ khó 3/5 1-2 ngày Mức phù hợp với người mới 64/100
ashhart/TensorFold#471 ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 3/5 1-2 ngày Mức phù hợp với người mới 68/100
ashhart/TensorFold#470 ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 4/5 3-5 ngày Mức phù hợp với người mới 52/100
ashhart/TensorFold#459 · 1 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 4/5 3-5 ngày Mức phù hợp với người mới 35/100
ashhart/TensorFold#457 · 1 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 4/5 3-5 ngày Mức phù hợp với người mới 62/100
ashhart/TensorFold#456 · 1 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 4/5 3-5 ngày Mức phù hợp với người mới 55/100
ashhart/TensorFold#451 · 1 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 3/5 1-2 ngày Mức phù hợp với người mới 66/100
ashhart/TensorFold#449 · 2 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
CUDA Flash Next: rope scaling (YaRN) beyond the native 262,144 tokens — input for the Zig serverĐang mở
Độ khó 4/5 3-5 ngày Mức phù hợp với người mới 32/100
ashhart/TensorFold#448 · 2 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 4/5 3-5 ngày Mức phù hợp với người mới 38/100
ashhart/TensorFold#447 · 2 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 4/5 3-5 ngày Mức phù hợp với người mới 32/100
ashhart/TensorFold#444 · 8 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 5/5 Hơn một tuần Mức phù hợp với người mới 30/100
ashhart/TensorFold#442 · 2 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Kolibri 1 (MLX): shared multi-stream forwards are not bit-exact, so streams take turnsCó thể làm lại được Pull request cho issue này đã bị đóng mà không được merge. Đang mở
Độ khó 5/5 Hơn một tuần Mức phù hợp với người mới 25/100
ashhart/TensorFold#434 · 3 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 5/5 Hơn một tuần Mức phù hợp với người mới 25/100
ashhart/TensorFold#428 · 3 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 5/5 Hơn một tuần Mức phù hợp với người mới 25/100
ashhart/TensorFold#426 · 10 bình luận · 1 reaction ·
Maintainer thường phản hồi trong vòng 1 ngày
-
GLM CUDA engine: `_take_over` clones every kept snapshot it is about to drop, so reserved memory spikes by about 15 GiB per rank when a new conversation follows a long oneCó thể làm lại được Pull request cho issue này đã bị đóng mà không được merge. Đang mở
Độ khó 4/5 3-5 ngày Mức phù hợp với người mới 25/100
ashhart/TensorFold#420 · 2 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 5/5 Hơn một tuần Mức phù hợp với người mới 30/100
ashhart/TensorFold#417 · 2 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 4/5 3-5 ngày Mức phù hợp với người mới 45/100
ashhart/TensorFold#414 · 4 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 5/5 Hơn một tuần Mức phù hợp với người mới 25/100
ashhart/TensorFold#412 · 6 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Proposal: optional Mojo kernels for the ROCm decode path (R9700: 6.6–10.5% faster decode, same bits)Đang mở
Độ khó 5/5 Hơn một tuần Mức phù hợp với người mới 25/100
ashhart/TensorFold#406 · 4 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 5/5 Hơn một tuần Mức phù hợp với người mới 25/100
ashhart/TensorFold#402 · 2 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
CUDA glm5_next (TP / --parallel): kept prompt states never use the conversation spill tier (--spill-gib / --snapshot-dir are MLX-only and silently ignored)Có thể làm lại được Pull request cho issue này đã bị đóng mà không được merge. Đang mở
Độ khó 5/5 Hơn một tuần Mức phù hợp với người mới 30/100
ashhart/TensorFold#373 · 3 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 4/5 3-5 ngày Mức phù hợp với người mới 54/100
ashhart/TensorFold#368 · 6 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
feat(vision): enable --vision for qwen3_5_moe (Qwen3.6-35B-A3B) on CUDACó thể làm lại được Pull request cho issue này đã bị đóng mà không được merge. Đang mở
Độ khó 5/5 Hơn một tuần Mức phù hợp với người mới 25/100
ashhart/TensorFold#366 · 2 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 5/5 Hơn một tuần Mức phù hợp với người mới 25/100
ashhart/TensorFold#339 · 2 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Flash Next CUDA `--parallel`: a growing conversation recaptures the lone-stream graphs at every context bucket and slot resize (single-stream decode −25…−60 % on those turns)Có thể làm lại được Pull request cho issue này đã bị đóng mà không được merge. Đang mở
Độ khó 5/5 Hơn một tuần Mức phù hợp với người mới 35/100
ashhart/TensorFold#336 · 2 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 5/5 Hơn một tuần Mức phù hợp với người mới 25/100
ashhart/TensorFold#322 · 1 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
CUDA: may the bf16 head (b16) decode on the mma for K % 64 == 0? It changes the head's sum orderĐang mở
Độ khó 4/5 3-5 ngày Mức phù hợp với người mới 35/100
ashhart/TensorFold#321 · 2 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Flash Next (MLX 4-bit + MTP) on a single DGX Spark: v0.6.4 decodes ~24% slower than v0.6.3, with a single streamCó thể làm lại được Pull request cho issue này đã bị đóng mà không được merge. Đang mở
Độ khó 4/5 3-5 ngày Mức phù hợp với người mới 35/100
ashhart/TensorFold#317 · 13 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 4/5 3-5 ngày Mức phù hợp với người mới 48/100
ashhart/TensorFold#314 · 1 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 5/5 Hơn một tuần Mức phù hợp với người mới 20/100
ashhart/TensorFold#313 · 1 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Laguna-S-2.1 (poolside) on Macs: a `laguna` family with DFlash drafts?Có thể làm lại được Pull request cho issue này đã bị đóng mà không được merge. Đang mở
Độ khó 5/5 Hơn một tuần Mức phù hợp với người mới 25/100
ashhart/TensorFold#312 · 1 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 5/5 Hơn một tuần Mức phù hợp với người mới 35/100
ashhart/TensorFold#311 · 1 bình luận · 2 reaction ·
Maintainer thường phản hồi trong vòng 1 ngày
-
Độ khó 5/5 Hơn một tuần Mức phù hợp với người mới 25/100
ashhart/TensorFold#310 · 5 bình luận ·
Maintainer thường phản hồi trong vòng 1 ngày