Command Palette
Search for a command to run...
Papers
최신 AI 트렌드를 파악할 수 있도록 매일 업데이트되는 최첨단 AI 연구 논문
개의 논문

ResearchMath-14K: Agents를 통한 연구 수준 수학의 확장

양방향 진화 탐색을 통한 자기 개선 언어 모델






























픽셀에서 단어로 -- 대규모 네이티브 원비전 모델을 향해
멀티모달 에이전트적 추론을 위한 Agent 탐색적 정책 최적화
ProRL: 보정된 정책 경사 추정을 통한 능동적 추천을 위한 효과적인 강화 학습
감마-월드: 두 플레이어를 넘어선 생성적 Multi-Agent 세계 모델링
AutoFigure: 출판 준비가 완료된 과학적 일러스트레이션 생성 및 개선
AutoResearch AI: 과학적 발견을 위한 AI 기반 연구 자동화 toward
에이전트 하니스 엔지니어링: 종합 조사
D^2-모니터: 주저 인식 라우팅을 통한 확산 LLM의 동적 안전 모니터링
강건한 다중 시점 3D 재구성을 위한 기하학적 인지 표현 잡음 제거
EvalVerse: 전문 시네마틱 영상 생성을 위한 파이프라인 인식 및 전문가 보정 기반 벤치마킹
MobileGym: 모바일 GUI Agent 연구를 위한 검증 가능하고 고도로 병렬화된 시뮬레이션 플랫폼
SpatialBench: 당신의 공간 파운데이션 모델은 올라운더인가?
LocateAnything: 병렬 박스 디코딩을 통한 빠르고 고품질의 비전-언어 그라운딩
Gemini Embedding 2: 제미니의 네이티브 멀티모달 임베딩 모델
언어 모델은 수면이 필요하다
ECHO: 터미널 에이전트는 무료로 월드 모델을 학습한다
ParaVT: Agentic 비디오 강화 학습에서 병렬 도구 사용을 위한 도구 사전 역설의 통제
TriSplat: 시뮬레이션 준비가 된 순방향 3D 장면 재구성
파운데이션 프로토콜: 에이전트 사회를 위한 조정 계층
WBench: 상호작용형 비디오 월드 모델 평가를 위한 포괄적인 다중 턴 벤치마크
Macaron-A2UI: 개인 에이전트에서의 생성형 UI를 위한 모델
DVAO: 다중 보상 강화 학습을 위한 동적 분산 적응형 이점 최적화
ViMU: 비디오 은유적 이해benchmarking
SMOL: 115개 미표현 언어를 위한 전문적으로 번역된 병렬 데이터
Chi-Bench: AI 에이전트가 종단적, 장기적, 정책 기반 의료 워크플로우를 자동화할 수 있는가?
대규모 언어 모델의 긴 맥락 추론을 위한 온-정책 최적화 및 증류 통합
단서의 시선: VLM에서의 자기 개선적 시각적 추론
HRM-Text: 규모 확장 이상의 효율적 사전 학습
내가 무엇을 의미하는지 보라: 비디오의 세분화된 객체 이해를 위해 시각 및 언어 표현 정렬하기
StepAudio 2.5 기술 보고서