연구

매일 커뮤니티 추천을 많이 받은 최신 AI 논문을 골라 문제·방법·결과·한계로 정리하고, 매주 분야별 주목 논문(의료 분야는 PubMed Central·bioRxiv·medRxiv 포함)을 모읍니다. 모두 무료로 읽을 수 있는 오픈 액세스 논문입니다.

이번 주 분야별 주목 논문 2026년 9월 30일 ~ 2026년 10월 6일

분야별 바로가기 · 고른 논문이 많은 분야부터

언어 모델

생성형 미디어

컴퓨터 비전

멀티모달

에이전트

피지컬 AI·로봇

강화학습

  • 사후 학습의 '날카로워지기 세금'

    Sharpening Tax in Post-Training

    간단한 하네스를 붙인 사전학습 모델이 한 번에 맞히는 정확도는 낮아도, 여러 번 시도하면 사후 학습 모델보다 더 많은 문제를 푸는 경우가 많았다.

    arXiv 2610.01509 · 추천 103 · 2026-10-01 · PDF · 코드

  • 직접 샘플링하지 않은 것에서도 배우기: 모델 간 궤적 교환 강화학습

    Learning Beyond What You Sample: Off-Policy-Aware Cross-Model Trajectory Exchange for RLVR

    모든 시도가 실패한 문제에서 다른 모델이 성공한 풀이를 빌려와, 별도의 강한 교사 없이 서로 배우게 하는 GRAFT를 제안한다.

    arXiv 2609.37868 · 추천 63 · 2026-09-29 · PDF

  • EasyPPO: 핵심은 크리틱 안정화

    EasyPPO: Stabilizing the Critic Is Key

    LLM용 PPO를 불안정하게 만드는 크리틱의 두 가지 실패 원인, 즉 잘린 응답 필터링과 프롬프트별 노이즈 차이를 찾아 해결한다.

    arXiv 2609.36802 · 추천 36 · 2026-09-29 · PDF

효율·인프라

안전·정렬

과학·바이오

데이터·평가

의료·헬스케어

음성·오디오

자율주행

주간 목록 따로 보기 →

매일 논문 리뷰

2026년 10월 7일 5

생성형 미디어멀티모달음성·오디오 고급 추천 117

Kandinsky 6.0 Video: 영상과 오디오를 동기화해 생성하는 파운데이션 모델

Kandinsky 6.0 Video: Foundation Models for Synchronized Video and Audio Generation

사전학습된 비디오 스트림과 새로 학습한 오디오 스트림을 양방향 크로스 어텐션으로 연결해, 립싱크가 맞는 5초 영상과 44kHz 오디오를 함께 생성하는 오픈 모델을 만들었다.

언어 모델효율·인프라 고급 추천 60

ALoDLM: 토큰마다 반복 깊이를 조절하는 루프형 확산 언어 모델

ALoDLM: Adaptively Looped Diffusion Language Models

확산 언어 모델에서 어려운 토큰만 잠재 상태를 더 반복해 다듬게 해서, 같은 크기의 자기회귀 모델보다 높은 평균 점수와 빠른 병렬 디코딩을 함께 얻었다.

생성형 미디어컴퓨터 비전 고급 추천 35

In-Distribution Forcing: 테스트 시점에 긴 영상을 생성하기 위한 분포 내 KV 운용

In-Distribution Forcing for Long Video Generation at Test Time

KV 캐시를 만드는 방식과 읽는 방식을 모두 학습 때의 구성에 맞추는 추가 학습 없는 기법으로, 5초 모델을 분 단위 영상 생성으로 늘리면서 색·움직임 드리프트를 줄였다.

에이전트안전·정렬언어 모델 중급 추천 33

MemAdapter: 메모리 때문에 생기는 아첨을 막는 반사실적 적응 프레임워크

Memadapter: Counterfactual Adaptation Against Memory-induced Sycophancy

검색한 메모리마다 반사실적 추론으로 위험 조건을 찾고 현재 과제에 맞게 영향력을 조정해서, LLM 에이전트의 메모리 기반 아첨을 줄였다.

에이전트데이터·평가피지컬 AI·로봇 중급 추천 31

LMBuild: 실제로 조립할 수 있고 작동하는 구조물을 만드는 LLM 에이전트 평가

LMBuild: Evaluating LLM Agents for Generating Buildable and Functional Structures

부품·관절·재료·조립 순서까지 포함해 구조물을 만드는 상호작용 환경과 4단계 평가 체계를 만들어 30개 시스템을 평가한 결과, 기능과 물리적 작동성이 가장 큰 약점임을 확인했다.