Skip to content

Pull requests: JustVugg/colibri

Author
Filter by author
Loading
Label
Filter by label
Loading
Use alt + click/return to exclude labels
or + click/return for logical OR
Projects
Filter by project
Loading
Milestones
Filter by milestone
Loading
Reviews
Assignee
Filter by who’s assigned
Assigned to nobody Loading
Sort

Pull requests list

Vulkan MoE GEMV backend for integrated/AMD GPUs (draft, complements #418) enhancement New feature or request vulkan Backend Vulkan/AMD
#729 opened Jul 31, 2026 by minne100 Draft
serve: trigger Claude Code system-role fallback enhancement New feature or request
#725 opened Jul 31, 2026 by t83714 Loading…
feat(kimi_k3): adopt the shared routing telemetry (#700) — stacked on #716 enhancement New feature or request model-support Supporto a nuovi modelli
#719 opened Jul 30, 2026 by terrizoaguimor Contributor Loading…
refactor(telemetry): one expert history for every engine (#700) enhancement New feature or request
#716 opened Jul 30, 2026 by terrizoaguimor Contributor Loading…
Release: Vulkan backend, Kimi K3 GPU tier, Metal grouped-int4, multi-SSD mirror enhancement New feature or request metal Backend Metal/Apple vulkan Backend Vulkan/AMD
#711 opened Jul 30, 2026 by JustVugg Owner Loading…
feat(win): fix silent CPU fallback, launcher suite, DirectStorage expert loads enhancement New feature or request needs-rebase Confligge, serve rebase dell'autore
#670 opened Jul 28, 2026 by khalilswdp Contributor Loading…
8 tasks done
feat(core): model-architecture seam, chat templates, text antiprompt enhancement New feature or request needs-rebase Confligge, serve rebase dell'autore
#667 opened Jul 28, 2026 by khalilswdp Contributor Loading…
5 tasks done
QLoRA training path: fine-tune GLM-5.2 (744B) in 64 GB RAM enhancement New feature or request feature Nuova funzionalità
#626 opened Jul 26, 2026 by pavolbauer Loading…
5 tasks done
Add opt-in per-expert causal-ablation harness (ABLATE_SCORE) for moe() enhancement New feature or request needs-rebase Confligge, serve rebase dell'autore
#621 opened Jul 25, 2026 by jeswr Loading…
docs(api): OpenAI server supports tool-calling docs Documentazione needs-rebase Confligge, serve rebase dell'autore
#620 opened Jul 25, 2026 by jeswr Loading…
Metal fmt=4 grouped-int4 decode: attention + routed experts (#585) metal Backend Metal/Apple needs-rebase Confligge, serve rebase dell'autore
#587 opened Jul 24, 2026 by RDouglasSharp Contributor Loading…
Preserve model-declared EOS tokens in serve mode enhancement New feature or request
#584 opened Jul 24, 2026 by saskw2010 Draft
Fix stateful KV tail at the NGEN limit bug Difetto verificato nel codice
#567 opened Jul 23, 2026 by winklemad Contributor Loading…
3 of 5 tasks
add persistence controls for lower SSD writes enhancement New feature or request
#555 opened Jul 23, 2026 by Skater1808 Loading…
5 tasks
CPU: KV cache quantization — KV8 (fp8 e4m3) + KV_TQ (rotated-int4 / PolarQuant) enhancement New feature or request performance Velocità / tok-s / ottimizzazioni
#553 opened Jul 23, 2026 by NeuralNotwerk Contributor Loading…
feat: add WebGPU expert workers enhancement New feature or request
#552 opened Jul 23, 2026 by gauravsaini Loading…
feat: add distributed expert workers enhancement New feature or request
#551 opened Jul 23, 2026 by gauravsaini Loading…
feat: add dense MLP activation sharding enhancement New feature or request performance Velocità / tok-s / ottimizzazioni
#550 opened Jul 23, 2026 by gauravsaini Loading…
feat: add Qwen3-30B-A3B engine model-support Supporto a nuovi modelli needs-rebase Confligge, serve rebase dell'autore
#544 opened Jul 23, 2026 by opxyc Contributor Loading…
4 of 5 tasks
feat: add learned partial mirror planner enhancement New feature or request
#536 opened Jul 22, 2026 by bherald Contributor Loading…
ProTip! Filter pull requests by the default branch with base:main.