Orthrus-Qwen3: up to 7.8×tokens/forward on Qwen3, identical output distribution

·Hacker News··

Fast, lossless LLM inference via dual-view diffusion decoding. - chiennv2000/orthrus

Read full article →

Related Articles

Federal judge calls Flock 'indiscriminate mass surveillance'
sbulaev · Hacker News · 9h ago
Kolibri: A Sovereign Open-Weight Model
bastitx · Hacker News · 21h ago
Pi 1.0
sergiotapia · Hacker News · 2d ago
Updates to Full Disk Access in macOS
notfirstpost · Hacker News · 1d ago
FTL: A new operating system for clouds
romac · Hacker News · 16h ago