PublishersGLM-5 Team
GLM-5 Team
1 document read from this publisher.
GLM-5: from Vibe Coding to Agentic Engineering
research paper · technical report · 2026-02-17 · 53 techniques
Mixture of ExpertsMulti-Token PredictionDeepSeek Sparse AttentionGroup Relative Policy OptimizationExpert ParallelismGated DeltaNetMuonSliding Window AttentionAsynchronous reinforcement learningDiscard-all context managementCosine decayPrefix cachingAgentic data synthesis pipelineAttention data parallelismBatch-size warmupPrefill-decode disaggregationAsynchronous schedulingIcePopLightning IndexerMulti-Head Latent AttentionToken-in-token-out (TITO)Agent-as-a-JudgeAsynchronous reinforcement learning infrastructureDirect Double-Sided Importance SamplingMulti-query attentionOn-Policy Cross-Stage DistillationRadixCacheRejection samplingAsynchronous Agent RL algorithmsDP-aware routingFlashCommFlex_AWQ_SSZFP8 inferenceGroup-Wise Policy OptimizationHeartbeat-driven fault toleranceHierarchical context managementHybrid reward systemINT4 Quantization-Aware TrainingKeep-recent-kmasking-based refinement