-
AgentConductor: Topology Evolution for Multi-Agent Competition-Level Code Generation
Paper • 2602.17100 • Published • 4 -
GroupGPT: A Token-efficient and Privacy-preserving Agentic Framework for Multi-User Chat Assistant
Paper • 2603.01059 • Published • 1 -
Multi-Domain Riemannian Graph Gluing for Building Graph Foundation Models
Paper • 2603.00618 • Published -
Heterogeneous Agent Collaborative Reinforcement Learning
Paper • 2603.02604 • Published • 110
Collections
Discover the best community collections!
Collections including paper arxiv:2501.13928
-
OpenOmni: Large Language Models Pivot Zero-shot Omnimodal Alignment across Language with Real-time Self-Aware Emotional Speech Synthesis
Paper • 2501.04561 • Published • 16 -
Fast3R: Towards 3D Reconstruction of 1000+ Images in One Forward Pass
Paper • 2501.13928 • Published • 17 -
Make-A-Character 2: Animatable 3D Character Generation From a Single Image
Paper • 2501.07870 • Published • 2
-
LoRA+: Efficient Low Rank Adaptation of Large Models
Paper • 2402.12354 • Published • 8 -
The FinBen: An Holistic Financial Benchmark for Large Language Models
Paper • 2402.12659 • Published • 24 -
TofuEval: Evaluating Hallucinations of LLMs on Topic-Focused Dialogue Summarization
Paper • 2402.13249 • Published • 14 -
TrustLLM: Trustworthiness in Large Language Models
Paper • 2401.05561 • Published • 69
-
Fast3R: Towards 3D Reconstruction of 1000+ Images in One Forward Pass
Paper • 2501.13928 • Published • 17 -
MV-DUSt3R+: Single-Stage Scene Reconstruction from Sparse Views In 2 Seconds
Paper • 2412.06974 • Published • 2 -
Align3R: Aligned Monocular Depth Estimation for Dynamic Videos
Paper • 2412.03079 • Published • 2 -
DUSt3R: Geometric 3D Vision Made Easy
Paper • 2312.14132 • Published • 2
-
Neural LightRig: Unlocking Accurate Object Normal and Material Estimation with Multi-Light Diffusion
Paper • 2412.09593 • Published • 18 -
CLEAR: Conv-Like Linearization Revs Pre-Trained Diffusion Transformers Up
Paper • 2412.16112 • Published • 23 -
Thinking in Space: How Multimodal Large Language Models See, Remember, and Recall Spaces
Paper • 2412.14171 • Published • 24 -
DiffSensei: Bridging Multi-Modal LLMs and Diffusion Models for Customized Manga Generation
Paper • 2412.07589 • Published • 48
-
AgentConductor: Topology Evolution for Multi-Agent Competition-Level Code Generation
Paper • 2602.17100 • Published • 4 -
GroupGPT: A Token-efficient and Privacy-preserving Agentic Framework for Multi-User Chat Assistant
Paper • 2603.01059 • Published • 1 -
Multi-Domain Riemannian Graph Gluing for Building Graph Foundation Models
Paper • 2603.00618 • Published -
Heterogeneous Agent Collaborative Reinforcement Learning
Paper • 2603.02604 • Published • 110
-
Fast3R: Towards 3D Reconstruction of 1000+ Images in One Forward Pass
Paper • 2501.13928 • Published • 17 -
MV-DUSt3R+: Single-Stage Scene Reconstruction from Sparse Views In 2 Seconds
Paper • 2412.06974 • Published • 2 -
Align3R: Aligned Monocular Depth Estimation for Dynamic Videos
Paper • 2412.03079 • Published • 2 -
DUSt3R: Geometric 3D Vision Made Easy
Paper • 2312.14132 • Published • 2
-
OpenOmni: Large Language Models Pivot Zero-shot Omnimodal Alignment across Language with Real-time Self-Aware Emotional Speech Synthesis
Paper • 2501.04561 • Published • 16 -
Fast3R: Towards 3D Reconstruction of 1000+ Images in One Forward Pass
Paper • 2501.13928 • Published • 17 -
Make-A-Character 2: Animatable 3D Character Generation From a Single Image
Paper • 2501.07870 • Published • 2
-
Neural LightRig: Unlocking Accurate Object Normal and Material Estimation with Multi-Light Diffusion
Paper • 2412.09593 • Published • 18 -
CLEAR: Conv-Like Linearization Revs Pre-Trained Diffusion Transformers Up
Paper • 2412.16112 • Published • 23 -
Thinking in Space: How Multimodal Large Language Models See, Remember, and Recall Spaces
Paper • 2412.14171 • Published • 24 -
DiffSensei: Bridging Multi-Modal LLMs and Diffusion Models for Customized Manga Generation
Paper • 2412.07589 • Published • 48
-
LoRA+: Efficient Low Rank Adaptation of Large Models
Paper • 2402.12354 • Published • 8 -
The FinBen: An Holistic Financial Benchmark for Large Language Models
Paper • 2402.12659 • Published • 24 -
TofuEval: Evaluating Hallucinations of LLMs on Topic-Focused Dialogue Summarization
Paper • 2402.13249 • Published • 14 -
TrustLLM: Trustworthiness in Large Language Models
Paper • 2401.05561 • Published • 69