Command Palette
Search for a command to run...
Papers
최신 AI 트렌드를 파악할 수 있도록 매일 업데이트되는 최첨단 AI 연구 논문
개의 논문

4D 공간 지능 복원: 종합 검토

Rep-MTL: 표현 수준의 태스크 유의성의 힘을 풀어내는 다중 태스크 학습






























ARC-Hunyuan-Video-7B: 실제 세계의 짧은 영상에 대한 구조화된 비디오 이해
업무적 강화 정책 최적화
사양 자기 수정: 테스트 시간 개선을 통한 문맥 내 보상 해킹 완화
AI와 대화하기: 인간에서 AI로의 실시간 영상 통신의 예상치 못한 전환
MMBench-GUI: GUI 에이전트를 위한 계층적 다중 플랫폼 평가 프레임워크
테스트 시기 확산을 갖춘 딥 리서처
LLM 양자화의 기하학: GPTQ는 바바이의 최근 평면 알고리즘
MedIQA: 프롬프트 기반 의료 영상 품질 평가를 위한 확장 가능한 기반 모델
OS-MAP: 컴퓨터 사용 에이전트가 넓이와 깊이에서 얼마나 멀리 갈 수 있을까?
계층적 예산 정책 최적화를 통한 적응적 추론
캐피틴 시네마: 짧은 영화 생성을 향하여
LAPO: 길이 적응형 정책 최적화를 통한 추론 효율성 내재화
MUR: 대규모 언어 모델을 위한 모멘텀 불확실성 유도 추론
∇NABLA: Neighborhood Adaptive Block-Level Attention
그룹 시퀀스 정책 최적화
SafeWork-R1: AI-45법 하에서 안전성과 지능의 공진화
LLMs에서 지식과 추론의 분리: 인지 이중시스템 이론을 활용한 탐구
Re:Form -- LLMs에서 RL을 활용한 확장 가능한 공식 소프트웨어 검증에서 인간 사전 지식 줄이기: Dafny에 대한 사전 연구
RAVine: 실제와 일치하는 평가: 에이전트 검색을 위한
한 영역이 다른 영역을 도와줄 수 있을까? 강화학습을 통한 다중 영역 추론에 대한 데이터 중심 연구
DesignLab: 반복적 탐지와 수정을 통한 슬라이드 설계
유메: 인터랙티브 월드 생성 모델
픽셀, 패턴, 하지만 시가 없다: 인간처럼 세상을 보다
안과용 MLLM 구축: 임상 인지 체인 추론을 통한 위치-진단 협업
HySafe-AI: 인공지능 시스템을 위한 하이브리드 안전 아키텍처 분석 프레임워크: 사례 연구
제브라-코트: 병행된 시각 언어 추론을 위한 데이터셋
시각-언어 지연 사고를 위한 반-오프-정책 강화 학습
업샘플링이 중요한 것: 가속화된 디퓨전 트랜스포머를 위한 영역 적응형 잠재 샘플링
MegaScience: 과학 추론을 위한 훈련 후 데이터셋의 경계를 넘어서기
Step-Audio 2 기술 보고서