首页 > 开发 > Hugging Face Hugging Face 共 4381 条资讯 Test-Time Gradient Guidance of Flow Policies in Reinforcement Learning Flow-DPPO: Divergence Proximal Policy Optimization for Flow Matching Models Data Journalist Agent: Transforming Data into Verifiable Multimodal Stories SCAIL-2: Unifying Controlled Character Animation with End-to-end In-Context Conditioning WorldOlympiad: Can Your World Model Survive a Triathlon? Workflow-GYM: Towards Long-Horizon Evaluation of Computer-use Agentic tasks in Real-World Professional Fields Attention Amnesia in Hybrid LLMs: When CoT Fine-Tuning Breaks Long-Range Recall, and How to Fix It ARM: An AutoRegressive Large Multimodal Model with Unified Discrete Representations One Token per Multimodal Evidence: Latent Memory for Resource-Constrained QA How Does Reasoning Flow? Tracing Attention-Induced Information Flow for Targeted RL in LLMs When the Chain of Thought Knows Better: Failure Modes in Multi-Turn Reasoning Models Lip Forcing: Few-Step Autoregressive Diffusion for Real-time Lip Synchronization EEVEE: Towards Test-time Prompt Learning in the Real World for Self-Improving Agents What Should Agents Say? Action-state Communication for Efficient Multi-Agent Systems SDR: Set-Distance Rewards for Radiology Report Generation Agents' Last Exam AsyncWebRL: Efficient Multi-Step RL for Visual Web Agents DEI: Diversity in Evolutionary Inference for Quality-Diversity Search Pruning and Distilling Mixture-of-Experts into Dense Language Models Robotic Policy Adaptation via Weight-Space Meta-Learning « 上一页1…8384858687…220下一页 » 相关分类 Hugging Face 51CTO ADGuider Android Police Android Weekly Update Android开发技术周报 Blow Studio Blur Studio CSDN CSDN博客 CSDN资讯 CSS-Tricks DEV Community