-
Continuous Latent Diffusion Language Model
Paper • 2605.06548 • Published • 87 -
Scaling Latent Reasoning via Looped Language Models
Paper • 2510.25741 • Published • 234 -
Scaling up Test-Time Compute with Latent Reasoning: A Recurrent Depth Approach
Paper • 2502.05171 • Published • 161 -
Pretraining Language Models to Ponder in Continuous Space
Paper • 2505.20674 • Published • 3
Collections
Discover the best community collections!
Collections including paper arxiv:2607.24653
-
Multi-Agent Computer Use
Paper • 2606.01533 • Published • 7 -
OpenSkill: Open-World Self-Evolution for LLM Agents
Paper • 2606.06741 • Published • 29 -
Socratic-SWE: Self-Evolving Coding Agents via Trace-Derived Agent Skills
Paper • 2606.07412 • Published • 12 -
Bayesian-Agent: Posterior-Guided Skill Evolution for LLM Agent Harnesses
Paper • 2606.08348 • Published • 16
-
Qwen/Qwen3-Coder-30B-A3B-Instruct
Text Generation • 31B • Updated • 837k • • 1.22k -
Qwen/Qwen3-Coder-Next
Text Generation • 80B • Updated • 500k • • 1.62k -
bigcode/starcoder2-15b-instruct-v0.1
Text Generation • 16B • Updated • 2.22k • 105 -
deepseek-ai/DeepSeek-Coder-V2-Instruct
Text Generation • 236B • Updated • 6.91k • 700
-
Kimi K3: Open Frontier Intelligence
Paper • 2607.24653 • Published • 508 -
Efficient Memory Management for Large Language Model Serving with PagedAttention
Paper • 2309.06180 • Published • 68 -
Language Models are Few-Shot Learners
Paper • 2005.14165 • Published • 21 -
Attention Is All You Need
Paper • 1706.03762 • Published • 140
-
Continuous Latent Diffusion Language Model
Paper • 2605.06548 • Published • 87 -
Scaling Latent Reasoning via Looped Language Models
Paper • 2510.25741 • Published • 234 -
Scaling up Test-Time Compute with Latent Reasoning: A Recurrent Depth Approach
Paper • 2502.05171 • Published • 161 -
Pretraining Language Models to Ponder in Continuous Space
Paper • 2505.20674 • Published • 3
-
Multi-Agent Computer Use
Paper • 2606.01533 • Published • 7 -
OpenSkill: Open-World Self-Evolution for LLM Agents
Paper • 2606.06741 • Published • 29 -
Socratic-SWE: Self-Evolving Coding Agents via Trace-Derived Agent Skills
Paper • 2606.07412 • Published • 12 -
Bayesian-Agent: Posterior-Guided Skill Evolution for LLM Agent Harnesses
Paper • 2606.08348 • Published • 16
-
Qwen/Qwen3-Coder-30B-A3B-Instruct
Text Generation • 31B • Updated • 837k • • 1.22k -
Qwen/Qwen3-Coder-Next
Text Generation • 80B • Updated • 500k • • 1.62k -
bigcode/starcoder2-15b-instruct-v0.1
Text Generation • 16B • Updated • 2.22k • 105 -
deepseek-ai/DeepSeek-Coder-V2-Instruct
Text Generation • 236B • Updated • 6.91k • 700
-
Kimi K3: Open Frontier Intelligence
Paper • 2607.24653 • Published • 508 -
Efficient Memory Management for Large Language Model Serving with PagedAttention
Paper • 2309.06180 • Published • 68 -
Language Models are Few-Shot Learners
Paper • 2005.14165 • Published • 21 -
Attention Is All You Need
Paper • 1706.03762 • Published • 140