Command Palette
Search for a command to run...
Papers
최신 AI 트렌드를 파악할 수 있도록 매일 업데이트되는 최첨단 AI 연구 논문
개의 논문

AgentFold: 선제적 컨텍스트 관리 기능을 갖춘 장기 예측 웹 에이전트

통의 딥리서치 기술 보고서




























인터랙트컴프: 모호한 질의를 활용한 검색 에이전트 평가
VLM-SlideEval: PPT 내 구조적 이해 및 변형에 대한 민감도 평가를 위한 VLM의 평가
TeraSim-World: 엔드투엔드 자율주행을 위한 전 세계 안전 핵심 데이터 합성
미래 예측 기반 고정: 오디오 주도 인간 애니메이션에서 성격 정체성 유지
VITA-E: 동시 시각, 청각, 발화 및 행동을 통한 자연스러운 몸을 가진 상호작용
FARMER: 픽셀 기반 흐름 자동회귀 변환기
데이터 에이전트에 대한 조사: 부상하는 패러다임인가, 과대포장된 화제인가?
ReCode: 일관된 계획과 실행을 통한 보편적 세분성 제어
콘체르토: 공동 2D-3D 자기지도 학습이 공간 표현을 촉발한다
매젤란: 잠재 공간 탐색 및 새로운 패턴 생성을 위한 지도형 MCTS
DEEDEE: 분포 외 동역학 탐지를 위한 빠르고 확장 가능한 방법
토큰 순열을 통한 희소 블록 희소 어텐션
AGI의 정의
노이즈 제거에서 정제로: 시각-언어 확산 모델을 위한 보정 프레임워크
샘플링 앤 스텝, 청크 단위 최적화: 텍스트에서 이미지 생성을 위한 청크 수준 GRPO
비디오-프롬프트: 비디오 생성을 위한 통합적 의미 제어
DeepAgent: 확장 가능한 도구 세트를 갖춘 일반적 추론 에이전트
불확실성 인지형 다중 목적 강화학습 유도 확산 모델을 활용한 3차원 신규 분자 설계
Reac-Discovery: 인공지능 기반의 연속유량 촉매 반응기 탐색 및 최적화 플랫폼
볼츠젠: 보편적인 바인더 설계를 향해
HSCodeComp: 계층적 규칙 적용을 위한 딥 서치 에이전트를 위한 현실적이고 전문가 수준의 벤치마크
DyPE: 초고해상도 확산을 위한 동적 위치 보간법
HoloCine: 영화적 다중 촬영 장편 비디오 내러티브의 종합적 생성
Open-o3 비디오: 명시적 시공간 증거를 통한 지능형 비디오 추론
AdaSPEC: 효율적인 사전 추론 디코더를 위한 선택적 지식 증류
0.1달러 미만의 인간-에이전트 협업 종이에서 페이지로의 제작
토큰화에서 시각적 해석으로
방향성 추론 주입을 통한 MLLM의 미세조정
언어 모델은 단사적이며 따라서 역함수를 가진다
프리 트랜스포머