Command Palette
Search for a command to run...
Papers
최신 AI 트렌드를 파악할 수 있도록 매일 업데이트되는 최첨단 AI 연구 논문
개의 논문

공자 코드 에이전트: 실세계 코드베이스를 위한 확장 가능한 에이전트 스케일링

드림스타일: 비디오 스타일라이제이션을 위한 통합 프레임워크






























유니코른: 자가 생성된 감독을 통한 자기 개선형 통합 다중모달 모델 지향
LTX-2: 효율적인 공동 오디오-비전 기반 모델
SciEvalKit: 과학적 일반지능을 위한 오픈소스 평가 키트
MOSS Transcribe Diarize: 화자 디아라이제이션을 통한 정확한 음성 인식
InfiniDepth: 신경 은닉 필드를 활용한 임의 해상도 및 세밀한 깊이 추정
에이전트형 AI의 적응
대규모 비디오 플래너를 통한 일반화 가능한 로봇 제어
무한VGGT: 끝없는 스트림을 위한 시각 기하 기반 트랜스포머
GARDO: 보상 해킹 없이 확산 모델 강화하기
VAR RL 올바르게 하기: 시각적 자동회귀 생성에서 비동기 정책 갈등 해결
DreamID-V: Diffusion Transformer를 통한 고해상도 얼굴 교체를 위한 이미지-비디오 갭 해소
NextFlow: 통합 순차 모델링이 다중모달 이해 및 생성을 활성화한다
K-EXAONE 기술 보고서
허기의 게임 논쟁: 다중 에이전트 시스템에서 과도한 경쟁의 부상에 관하여
루브릭 보상으로 AI 공동 과학자 훈련하기
AdaGaR: 동적 장면 재구성 위한 적응형 고바르 표현
가짜 정보 제어하기: 반사적 비디오 생성을 통한 MLLM의 비디오 이해 능력 향상
SenseNova-MARS: 강화학습을 통한 다중모달 에이전트 추론 및 검색 능력 강화
에이버터 포르싱: 자연스러운 대화를 위한 실시간 상호작용형 헤드 에이버터 생성
NeoVerse: 자연 환경의 단안 영상으로 4D 월드 모델 향상하기
유튜브-에이전트: 자동 생성과 하이브리드 정책 최적화를 통한 에이전트 생산성 확장
IQuest-Coder-V1 기술 보고서
재귀적 언어 모델
FlowBlending: 빠르고 고정밀 영상 생성을 위한 단계 인식 다중 모델 샘플링
Dream2Flow: 3D 객체 흐름을 통한 영상 생성과 오픈 월드 조작 연결
확산 LLM에서 이산성의 역할에 대하여
DiffThinker: 확산 모델을 통한 생성형 다중모달 추론으로 나아가기
동적 대규모 개념 모델: 적응형 의미 공간에서의 잠재적 추론
다중 스텝 RAG의 향상: 긴 컨텍스트 복잡한 관계 모델링을 위한 하이퍼그래프 기반 메모리
AI가 뇌를 만난다: 인지신경과학에서 자율 에이전트로의 기억 시스템