Command Palette
Search for a command to run...
Papers
최신 AI 트렌드를 파악할 수 있도록 매일 업데이트되는 최첨단 AI 연구 논문
개의 논문

ASA: 도구 호출 도메인 적응을 위한 활성화 조정

PhyCritic: 물리 AI를 위한 다중 모달 비평가 모델






























GENIUS: 생성형 유동지능 평가 세트
스텝 3.5 플래시: 11B 개의 액티브 파라미터를 활용한 오픈 프론티어 수준의 지능 열기
월드-VLA-루프: 비디오 월드 모델과 VLA 정책의 폐루프 학습
자율 수학 연구를 향하여
에이전트 월드 모델: 에이전트 기반 강화 학습을 위한 무한 합성 환경
P1-VL: 물리 올림피아드에서 시각 인지와 과학적 추론 연결하기
마인드셋의 사슬: 적응형 인지 모드를 통한 추론
UI-Venus-1.5 기술 보고서
Code2World: 렌더러블 코드 생성을 통한 GUI 월드 모델
OPUS: 대규모 언어 모델 사전 훈련에서 각 반복 단계마다 효율적이고 원칙적인 데이터 선택을 위한 방향성
BagelVLA: 시각-언어-행동 병행 생성을 통한 장기 지속 조작 성능 향상
THINGS-data: 인간의 뇌와 행동 내 객체 표상(object representations) 조사를 위한 대규모 멀티모달 데이터셋 컬렉션
IsoDDE를 이용한 새로운 생체 분자 상호작용의 정확한 예측
SKILLRL: 재귀적 기술 증강 강화 학습을 통한 Agent의 진화
LLaDA2.1: 토큰 편집을 통한 텍스트 디퓨전의 속도 향상
기반 흐름 GRPO에서 단계별 및 장기적 샘플링 효과 모델링을 통한 희소 보상 완화
순환-깊이 VLA: 잠재 반복 추론을 통한 시각-언어-행동 모델의 은닉 테스트 타임 컴퓨팅 스케일링
쿼란타알파: LLM 기반 알파 탐사 위한 진화적 프레임워크
모달리티 갭 기반 서브스페이스 정렬 학습 프레임워크: 다중모달 대규모 언어 모델을 위한 접근법
MOVA: 확장 가능하고 동기화된 비디오-오디오 생성을 향해
MemoryLLM: 즉시 사용 가능한 해석 가능한 피드포워드 메모리 기반 트랜스포머
드림도조: 대규모 인간 영상에서 얻은 일반화 로봇 월드 모델
F-GRPO: 정책이 명백한 것을 배우는 것을 막고 희귀한 것을 잊지 않도록 하라
MSign: 대규모 언어 모델에서 안정적인 랭크 복원을 통한 훈련 불안정성 방지 최적화기
AudioSAE: 음성 처리 모델에 대한 이해를 위한 스파스 오토인코더 접근
대규모 언어 모델의 강화 학습 미세조정에서의 엔트로피 동역학
오디세이아레인: 장기적, 능동적, 유도적 상호작용을 위한 대규모 언어모델 평가
백천-M3: 신뢰할 수 있는 의료 결정을 위한 임상적 질문 모델링
드리프팅을 통한 생성 모델링
AlphaEdit: 언어 모델을 위한 영공간 제약 지식 편집