HotPaper.ai — 매일 자동 큐레이션되는 AI 논문 Top 25 + 한국어 요약

2026-10-10 featured 논문 30편

  1. #1Memento 3: Model-Based Recursive Self-Improvement through Reflective Rulebooks

  2. #2Nemotron-CC: Transforming Common Crawl into a Refined Long-Horizon Pretraining Dataset

    Nemotron-CC는 Common Crawl 데이터를 활용해 정확도와 데이터 양의 균형을 맞춘 6.3T 토큰의 훈련 데이터셋을 제시한다.

    Dan Su, Kezhi Kong, Ying Lin, Joseph Jennings, Brandon Norick

  3. #3Devils in Middle Layers of Large Vision-Language Models: Interpreting, Detecting and Mitigating Object Hallucinations via Attention Lens

    LVLM에서 시각 정보 처리 단계를 분석하여 오브젝트 환영을 감지하고 완화하는 새로운 방법을 제안한다.

    Zhangqi Jiang, Junkai Chen, Beier Zhu, Tingjin Luo, Yankun Shen

  4. #4Multi-Agent Egocentric World Model with Fine-Grained Embodied Interaction

  5. #5DreamTrue: Action-Faithful Robot World Model with Counterfactual Post-Training

  6. #6U-Space: Uncovering When and Why Uncertainty Arises in Language Models

  7. #7LiveBench: A Challenging, Contamination-Limited LLM Benchmark

    LiveBench는 테스트 세트 오염과 LLM 평가의 편향을 방지하기 위해 설계된, 월별 업데이트와 객관적 평가를 기반으로 한 LLM 벤치마크이다.

    Colin White, Samuel Dooley, Manley Roberts, Arka Pal, Ben Feuer

  8. #8Investigating Cultural Alignment of Large Language Models

    LLM의 문화적 정합성을 평가하고 언어와 사전학습 데이터의 영향을 분석하여, 문화적 다변성을 반영한 새로운 프롬프팅 방법을 제안한다.

    Badr AlKhamissi, Muhammad N. ElNokrashy, Mai Alkhamissi, Mona T. Diab

  9. #9Teaching Large Language Models to Regress Accurate Image Quality Scores Using Score Distribution

    DeQA-Score는 MLLM 기반의 정확한 이미지 품질 점수 회귀를 위해 분포 기반 소프트 라벨과 퓨이델리티 손실을 도입한 모델이다.

    Zhiyuan You, Xin Cai, Jinjin Gu, Tianfan Xue, Chao Dong

  10. #10The Unreasonable Effectiveness of Entropy Minimization in LLM Reasoning

    엔트로피 최소화(EM)를 통해 라벨 없이도 LLM의 수학, 물리, 코딩 성능을 크게 향상시킬 수 있음을 보인 연구.

    Shivam Agarwal, Shivam Agarwal, Zimin Zhang, Lifan Yuan, Jiawei Han

  11. #11AdaIR: Adaptive All-in-One Image Restoration via Frequency Mining and Modulation

    AdaIR은 주파수 분해와 조절을 통해 다양한 이미지 복원 작업에서 최신 성능을 달성한 적응형 통합 복원 모델이다.

    Yuning Cui, Syed Waqas Zamir, Salman H. Khan, Alois Knoll, Mubarak Shah

  12. #12MotionLCM: Real-time Controllable Motion Generation via Latent Consistency Model

    MotionLCM은 텍스트와 제어 신호를 기반으로 실시간 인체 동작을 생성하는 새로운 모델로, 1단계 추론과 ControlNet을 통해 빠른 속도와 정밀 제어를 달성한다.

    Wen-Dao Dai, Ling-Hao Chen, Jingbo Wang, Jinpeng Liu, Bo Dai

  13. #13Robust Prompt Optimization for Defending Language Models Against Jailbreaking Attacks

    RPO는 적대적 프롬프트 공격에 대응하기 위해 최적화 기반 방어 알고리즘으로, GPT-4와 Llama-2에서 ASR을 각각 6%와 0%까지 감소시킨다.

    Andy Zhou, Bo Li, Haohan Wang

  14. #14DuQuant: Distributing Outliers via Dual Transformation Makes Stronger Quantized LLMs

    DuQuant은 회전 및 순열 변환을 활용해 4비트 정량화에서도 LLM 성능을 크게 향상시키는 새로운 정량화 방법이다.

    Haokun Lin, Haobo Xu, Yichen Wu, Jingzhi Cui, Yingtao Zhang

  15. #305WorldGuide: Goal-Directed Video World Model for Procedural Task Execution

  16. #306A GPU-Parallel Framework for Heterogeneous Multi-Task Reinforcement Learning

  17. #307MiMo-V2.6: Scaling Reinforcement Learning Towards Self-Improvement

  18. #308Learn2Play Bench: How Well Do LLM Agents Learn from Experience in Unfamiliar Environments?

  19. #309OuroWorld: Bringing Any 3D World Alive as Diverse, Endlessly Looping 3D Cinemagraphs

  20. #310SPW-Nav: A Streaming Panoramic World Model for Language-Guided Navigation

  21. #311Foundations of Large Language Models

    BERT 모델의 기본 아키텍처와 하이퍼파라미터 설정을 설명하며, LLM 개발의 기초를 다룬다.

  22. #312TestPrism: Rethinking Test Evaluation Beyond a Single Reference

  23. #313MC-Sparse: Deconstructing and Closing the Dense-Sparse Attention Gap in Diffusion Transformers

    MC-Sparse는 토큰 수준의 정밀한 어텐션 선택과 타일 정렬 그룹핑을 결합한 훈련 없이 가능한 확산 트랜스포머 가속 프레임워크로, 1.80×~2.32×의 가속 성능을 보인다.

  24. #314Post-Training Frontier Text-to-Image Models by Composing Preference and Rubric Rewards

  25. #315Beyond Spatio-Temporal Priors: A Generalizable Approach for Dense Correspondence Matching

  26. #316Synthesis Through Simulation: Generating Coherent Enterprise Data via Scalable Agent-System Interaction

  27. #317LEGO: A Lifting-Free Approach for Exocentric-to-Egocentric Video Generation

  28. #318OneSearch-VL: Unified Multimodal Deep Research Agent for Image and Video

  29. #319SparseEngine: Sparse-First Inference Engine

  30. #320OmniCapBench: A Deep-Structured Evaluation Framework for Fine-Grained Audio-Visual Captioning

인기 키워드

reinforcement-learning (414) diffusion-models (235) llm (225) llm-agents (190) video-generation (170) llm-evaluation (161) vision-language (160) transformer (154) large-language-models (143) long-context (124) code-generation (114) vlm (112) language-models (108) long-horizon (107) benchmark-evaluation (103) benchmarking (103) foundation-models (84) retrieval-augmented (84) chain-of-thought (82) world-models (82)