Owner
ashhart
已索引 1 个仓库 · 在 GitHub 查看
-
TensorFold
Fast, exact LLM decoding on Apple Silicon (MLX) behind an OpenAI-compatible endpoint
Python · 995 个 star
可能已有人在做的 issue 排在最后。 全部按时间排序
-
难度 3/5 1-2 天 新手友好度 62/100
ashhart/TensorFold#538 ·
维护者通常 1 天内回复
-
难度 2/5 1-3 小时 新手友好度 35/100
ashhart/TensorFold#537 ·
维护者通常 1 天内回复
-
Qwen3.5 native decode on the 27B: what bounds the projection kernel, and the FP32 family (parked)未关闭
难度 5/5 一周以上 新手友好度 8/100
ashhart/TensorFold#527 · 4 条评论 ·
维护者通常 1 天内回复
-
难度 5/5 一周以上 新手友好度 8/100
ashhart/TensorFold#522 ·
维护者通常 1 天内回复
-
难度 4/5 3-5 天 新手友好度 22/100
ashhart/TensorFold#512 ·
维护者通常 1 天内回复
-
难度 4/5 3-5 天 新手友好度 42/100
ashhart/TensorFold#511 · 1 条评论 ·
维护者通常 1 天内回复
-
难度 4/5 3-5 天 新手友好度 48/100
ashhart/TensorFold#510 ·
维护者通常 1 天内回复
-
--learn: no free-disk floor, so a full disk makes each new session retry a full learned-state write未关闭
难度 5/5 一周以上 新手友好度 25/100
ashhart/TensorFold#508 ·
维护者通常 1 天内回复
-
难度 5/5 一周以上 新手友好度 25/100
ashhart/TensorFold#505 ·
维护者通常 1 天内回复
-
难度 5/5 一周以上 新手友好度 25/100
ashhart/TensorFold#504 ·
维护者通常 1 天内回复
-
难度 5/5 一周以上 新手友好度 25/100
ashhart/TensorFold#503 ·
维护者通常 1 天内回复
-
难度 3/5 1-2 天 新手友好度 68/100
ashhart/TensorFold#498 · 1 条评论 ·
维护者通常 1 天内回复
-
难度 5/5 一周以上 新手友好度 25/100
ashhart/TensorFold#494 ·
维护者通常 1 天内回复
-
难度 5/5 一周以上 新手友好度 25/100
ashhart/TensorFold#491 · 1 条评论 · 1 个 reaction ·
维护者通常 1 天内回复
-
难度 5/5 一周以上 新手友好度 1/100
ashhart/TensorFold#481 ·
维护者通常 1 天内回复
-
难度 1/5 1 小时以内 新手友好度 35/100
ashhart/TensorFold#479 · 1 条评论 ·
维护者通常 1 天内回复
-
Dense NVIDIA Qwen3.8 NVFP4 native vision: tested Python 0.6.0 compatibility patch and reproducer未关闭
难度 5/5 一周以上 新手友好度 35/100
ashhart/TensorFold#474 · 1 条评论 ·
维护者通常 1 天内回复
-
难度 3/5 1-2 天 新手友好度 64/100
ashhart/TensorFold#471 ·
维护者通常 1 天内回复
-
难度 3/5 1-2 天 新手友好度 68/100
ashhart/TensorFold#470 ·
维护者通常 1 天内回复
-
难度 4/5 3-5 天 新手友好度 52/100
ashhart/TensorFold#459 · 1 条评论 ·
维护者通常 1 天内回复
-
难度 4/5 3-5 天 新手友好度 35/100
ashhart/TensorFold#457 · 1 条评论 ·
维护者通常 1 天内回复
-
难度 4/5 3-5 天 新手友好度 62/100
ashhart/TensorFold#456 · 1 条评论 ·
维护者通常 1 天内回复
-
难度 4/5 3-5 天 新手友好度 55/100
ashhart/TensorFold#451 · 1 条评论 ·
维护者通常 1 天内回复
-
难度 3/5 1-2 天 新手友好度 66/100
ashhart/TensorFold#449 · 2 条评论 ·
维护者通常 1 天内回复
-
CUDA Flash Next: rope scaling (YaRN) beyond the native 262,144 tokens — input for the Zig server未关闭
难度 4/5 3-5 天 新手友好度 32/100
ashhart/TensorFold#448 · 2 条评论 ·
维护者通常 1 天内回复
-
难度 4/5 3-5 天 新手友好度 38/100
ashhart/TensorFold#447 · 2 条评论 ·
维护者通常 1 天内回复
-
难度 4/5 3-5 天 新手友好度 32/100
ashhart/TensorFold#444 · 8 条评论 ·
维护者通常 1 天内回复
-
难度 5/5 一周以上 新手友好度 30/100
ashhart/TensorFold#442 · 2 条评论 ·
维护者通常 1 天内回复
-
Kolibri 1 (MLX): shared multi-stream forwards are not bit-exact, so streams take turns可能重新可做 关联的 PR 已关闭且未合并。 未关闭
难度 5/5 一周以上 新手友好度 25/100
ashhart/TensorFold#434 · 3 条评论 ·
维护者通常 1 天内回复
-
难度 5/5 一周以上 新手友好度 25/100
ashhart/TensorFold#428 · 3 条评论 ·
维护者通常 1 天内回复
-
难度 5/5 一周以上 新手友好度 25/100
ashhart/TensorFold#426 · 10 条评论 · 1 个 reaction ·
维护者通常 1 天内回复
-
GLM CUDA engine: `_take_over` clones every kept snapshot it is about to drop, so reserved memory spikes by about 15 GiB per rank when a new conversation follows a long one可能重新可做 关联的 PR 已关闭且未合并。 未关闭
难度 4/5 3-5 天 新手友好度 25/100
ashhart/TensorFold#420 · 2 条评论 ·
维护者通常 1 天内回复
-
难度 5/5 一周以上 新手友好度 30/100
ashhart/TensorFold#417 · 2 条评论 ·
维护者通常 1 天内回复
-
难度 4/5 3-5 天 新手友好度 45/100
ashhart/TensorFold#414 · 4 条评论 ·
维护者通常 1 天内回复
-
难度 5/5 一周以上 新手友好度 25/100
ashhart/TensorFold#412 · 6 条评论 ·
维护者通常 1 天内回复
-
Proposal: optional Mojo kernels for the ROCm decode path (R9700: 6.6–10.5% faster decode, same bits)未关闭
难度 5/5 一周以上 新手友好度 25/100
ashhart/TensorFold#406 · 4 条评论 ·
维护者通常 1 天内回复
-
难度 5/5 一周以上 新手友好度 25/100
ashhart/TensorFold#402 · 2 条评论 ·
维护者通常 1 天内回复
-
CUDA glm5_next (TP / --parallel): kept prompt states never use the conversation spill tier (--spill-gib / --snapshot-dir are MLX-only and silently ignored)可能重新可做 关联的 PR 已关闭且未合并。 未关闭
难度 5/5 一周以上 新手友好度 30/100
ashhart/TensorFold#373 · 3 条评论 ·
维护者通常 1 天内回复
-
难度 4/5 3-5 天 新手友好度 54/100
ashhart/TensorFold#368 · 6 条评论 ·
维护者通常 1 天内回复
-
feat(vision): enable --vision for qwen3_5_moe (Qwen3.6-35B-A3B) on CUDA可能重新可做 关联的 PR 已关闭且未合并。 未关闭
难度 5/5 一周以上 新手友好度 25/100
ashhart/TensorFold#366 · 2 条评论 ·
维护者通常 1 天内回复
-
难度 5/5 一周以上 新手友好度 25/100
ashhart/TensorFold#339 · 2 条评论 ·
维护者通常 1 天内回复
-
Flash Next CUDA `--parallel`: a growing conversation recaptures the lone-stream graphs at every context bucket and slot resize (single-stream decode −25…−60 % on those turns)可能重新可做 关联的 PR 已关闭且未合并。 未关闭
难度 5/5 一周以上 新手友好度 35/100
ashhart/TensorFold#336 · 2 条评论 ·
维护者通常 1 天内回复
-
难度 5/5 一周以上 新手友好度 25/100
ashhart/TensorFold#322 · 1 条评论 ·
维护者通常 1 天内回复
-
CUDA: may the bf16 head (b16) decode on the mma for K % 64 == 0? It changes the head's sum order未关闭
难度 4/5 3-5 天 新手友好度 35/100
ashhart/TensorFold#321 · 2 条评论 ·
维护者通常 1 天内回复
-
Flash Next (MLX 4-bit + MTP) on a single DGX Spark: v0.6.4 decodes ~24% slower than v0.6.3, with a single stream可能重新可做 关联的 PR 已关闭且未合并。 未关闭
难度 4/5 3-5 天 新手友好度 35/100
ashhart/TensorFold#317 · 13 条评论 ·
维护者通常 1 天内回复
-
难度 4/5 3-5 天 新手友好度 48/100
ashhart/TensorFold#314 · 1 条评论 ·
维护者通常 1 天内回复
-
难度 5/5 一周以上 新手友好度 20/100
ashhart/TensorFold#313 · 1 条评论 ·
维护者通常 1 天内回复
-
Laguna-S-2.1 (poolside) on Macs: a `laguna` family with DFlash drafts?可能重新可做 关联的 PR 已关闭且未合并。 未关闭
难度 5/5 一周以上 新手友好度 25/100
ashhart/TensorFold#312 · 1 条评论 ·
维护者通常 1 天内回复
-
难度 5/5 一周以上 新手友好度 35/100
ashhart/TensorFold#311 · 1 条评论 · 2 个 reaction ·
维护者通常 1 天内回复
-
难度 5/5 一周以上 新手友好度 25/100
ashhart/TensorFold#310 · 5 条评论 ·
维护者通常 1 天内回复