Command Palette
Search for a command to run...
Papers
최신 AI 트렌드를 파악할 수 있도록 매일 업데이트되는 최첨단 AI 연구 논문
개의 논문

GenRecal: 대형에서 소형 비전-언어 모델로의 재교정 후 생성

ProtoReasoning: 프로토타입을 기반으로 한 일반화 가능한 추론 LLMs에서 프로토타입이 일반화 가능한 추론의 기초로 작용하는 방식에 대해 설명합니다.






























Sekai: 세계 탐사를 위한 비디오 데이터셋
QFFT, 질문 없는 적응형 추론을 위한 미세 조정(Question-Free Fine-Tuning for Adaptive Reasoning)
LLM이 알고리즘 문제에 대한 고품질 테스트 케이스를 생성할 수 있는가? TestCase-Eval: 오류 커버리지 및 노출의 체계적인 평가
AceReason-Nemotron 1.1: SFT와 RL의 시너지를 통해 수학과 코드 추론 능력 향상
스트림-오미니: 대형 언어-시각-음성 모델을 이용한 동시 다모달 상호작용
강화학습을 통한 효율적인 의료 VIE
테스트 시간 계산 확장 for LLM 에이전트
TaskCraft: 자동화된 에이전틱 작업 생성
대기, 우리는 "대기"할 필요가 없습니다! 사고 토큰 제거가 추론 효율성을 개선합니다.
Ego-R1: 초장기 자기중심 비디오 추론을 위한 도구 사고 체인
DeepResearch Bench: 깊은 연구 에이전트를 위한 포괄적인 벤치마크
과학자들의 첫 번째 시험: 지각, 이해, 추론을 통한 MLLM의 인지 능력 탐구
MiniMax-M1: 라이트닝 어텐션을 활용한 테스트 시간 컴퓨팅 효율성 확장
균일한 주의력 너머: 푸리에 근사 KV 캐시를 통한 메모리 효율적인 LLMs
고품질 데이터셋과 신뢰성 있는 평가를 위한 교차 이미지-텍스트 생성
SwS: 자기 인식 기반 약점 주도 문제 합성 강화 학습을 통한 LLM 추론
LiveCodeBench Pro: 올림피아드 메달리스트들이 경쟁 프로그래밍에서 LLMs를 어떻게 평가하는가?
확산의 이중성
정책 준수 에이전트의 효과적인 레드팀 구성
교차 모달 주의력 전달을 통한 일치된 신규 시점 이미지 및 기하 합성
VRBench: 장편 내러티브 비디오에서 다단계 추론을 위한 벤치마크
AniMaker: MCTS-Driven 클립 생성을 이용한 자동화된 다중 에이전트 애니메이션 스토리텔링
텍스트 인식 이미지 복원을 위한 확산 모델
마지스틀라르
SWE-Factory: 이슈 해결 훈련 데이터 및 평가 벤치마크의 자동화된 공장
ReasonMed: 의료 추론을 발전시키기 위한 370,000개 다중 에이전트 생성 데이터셋
Auto-Regressive vs Flow-Matching: 텍스트-음악 생성을 위한 모델링 패러다임의 비교 연구
SeerAttention-R: 긴 추론을 위한 희소 주의력 적응
플레이어원: 자기중심적 세계 시뮬레이터
ComfyUI-R1: 워크플로 생성을 위한 추론 모델 탐구