Command Palette
Search for a command to run...
Papers
최신 AI 트렌드를 파악할 수 있도록 매일 업데이트되는 최첨단 AI 연구 논문
개의 논문

OmniVideo-100K: 구조화된 스크립트와 증거 체인을 통한 오디오-비주얼 추론을 위한 데이터셋

OPEN-SWE-TRACES: 소프트웨어 엔지니어링 에이전트를 위한 이중 모드 다국어 지식 증류의 고도화






























언어 모델 추론에서 리셋이 포함된 크레딧 할당
무제한 OCR 작업 가능: 원샷 장기 파싱의 시대 환영
PlanBench-XL: 대규모 도구 생태계에서 LLM 도구 사용 Agents의 장기 계획 평가
OpenRath: Agent 시스템을 위한 세션 중심의 런타임 상태
EvoEmbedding: 긴 컨텍스트 검색 및 Agentic 메모리를 위한 진화 가능한 표현
자신의 실수로부터 배우기: 자기 증류를 위한 학습 가능한 미세 반성 궤적 구성하기
세계 행동 모델: 조사
KaLM-Reranker-V1: 압축 문서 재순위 매기기를 위한 빠르지만 후기 상호작용이 아닌
LLM FP4 사전학습에서 수축 편향 재고찰: 기하학적 기원, 체계적 영향, 및 UFP4 레시피
HydraHead: 헤드 수준의 기능적 이질성에서 전문화된 어텐션 혼합으로
3DCodeBench: 코드를 통한 Agentic Procedural 3D 모델링 벤치마킹
RadImageNet-VQA: 방사학 시각 질문 답변을 위한 대규모 CT 및 MRI 데이터셋
SWE-Gym을 활용한 소프트웨어 엔지니어링 에이전트 및 검증자의 훈련
MAKIEVAL: LLMs에 대한 문화적 인식 평가를 위한 다국어 자동 WiKIdata 기반 프레임워크
GeneralVLA-2: 로봇 계획을 위한 기하학적 인식 재구성 및 통제된 메모리
다중 턴 성찰적 마스킹이 마스크 디퓨전 모델에서 추론을 이끌어낸다
BrainG3N: 제어 가능한 3D 뇌 MRI 생성을 위한 이중 목적 토크나이저
GateMem: 다중 원리자 공유 메모리 Agents에서의 메모리 거버넌스 벤치마킹
MemSlides: 다중 턴 로컬 수정을 통한 개인화된 슬라이드 생성을 위한 계층적 메모리 구동 Agent 프레임워크
PerceptionDLM: 멀티모달 확산 언어 모델을 이용한 병렬 영역 지각
일반 게임 플레이를 위한 코드 월드 모델
정적 리더보드를 넘어: LLM agents 평가를 위한 예측 타당도
S-Agent: 공간적 도구 사용이 공간 지능을 위한 추론을 이끌어낸다
Multi-LCB: LiveCodeBench를 여러 프로그래밍 언어로 확장
장난기 있는 에이전트 기반 로봇 학습
DragMesh-2: 관절형 물체와의 물리적으로 타당한 정교한 손-물체 상호작용
Moebius: 10B급 성능을 갖춘 0.2B 경량 이미지 인페인팅 프레임워크
EfficientRollout: RL 롤아웃을 위한 시스템 인지형 자기 예측 디코딩
올바른 교사를 신뢰하라: GUI 그라운딩을 위한 품질 인식 자기 증류
공간 시각 언어 모델에서의 이중 경로 추론 강화