Command Palette
Search for a command to run...
Papers
최신 AI 트렌드를 파악할 수 있도록 매일 업데이트되는 최첨단 AI 연구 논문
개의 논문

LLM 페르소나가 방법 비교 평가에서 현장 실험의 대체재가 되는 경우

DataFlow: 데이터 중심 인공지능 시대의 통합 데이터 준비 및 워크플로우 자동화를 위한 LLM 기반 프레임워크






























HiStream: 재현성 제거 스트리밍을 통한 효율적인 고해상도 비디오 생성
TokSuite: 토크나이저 선택이 언어 모델 행동에 미치는 영향 측정
Nemotron 3 Nano: Agentic Reasoning을 위한 오픈형, 효율적인 Mixture-of-Experts 하이브리드 Mamba-Transformer 모델
기억력 이상: 시각-언어 모델의 인기 편향을 드러내기 위한 다중 모달 순서 회귀 벤치마크
DreaMontage: 임의 프레임 유도형 원샷 영상 생성
T2AV-Compass: 텍스트-음성-비디오 생성을 위한 통합 평가 방향 탐색
TongSIM: 지능형 기계를 위한 일반 플랫폼
Qwen-Image-Layered: 계층 분해를 통한 내재적 편집 가능성 추구
로보세이프: 실행 가능한 안전 논리에 의한 신체화된 에이전트의 보호
영국 국민보건서비스(NHS) 원격의료에서의 대규모언어모델(LLM) 약물안전성 검토의 실제 적용 평가
다중 LLM 주제 분석 및 이중 신뢰도 지표: 질적 연구 검증을 위한 코헨의 카파와 의미 유사성의 결합
비디오 아바타를 통한 폐쇄 루프 월드 모델링을 통한 능동 지능
FaithLens: 충실도 환각 감지 및 설명
SAM 오디오: 오디오 내에서 무엇이든 분할하기
스텝딥리서치 기술 보고서
SpatialTree: MLLMs에서 공간 능력이 어떻게 분기되는가
SemanticGen: 의미 공간에서의 비디오 생성
사람이 루프 내에 포함된 추론 대규모 언어 모델 에이전트를 이용한 자동화된 입체적 방사선 수술 계획 수립
롱비디오에이전트: 긴 영상에서의 다중 에이전트 추론
GenEnv: LLM 에이전트와 환경 시뮬레이터 간의 난이도 일치형 공진화
월드워프: 비동기 영상 디퓨전을 통한 3D 기하학의 전파
LoGoPlanner: 메트릭 인지 시각 기하를 기반으로 한 위치 인식 기반 내비게이션 정책
LLM은 학습자 곤란을 추정할 수 있는가? 전문성 시뮬레이션을 통한 인간-AI 어려움 일치를 통한 항목 어려움 예측
QuCo-RAG: 사전 훈련 코퍼스로부터의 불확실성 정량화를 통한 동적 검색 증강 생성
프리즘 가설: 통합 오토인코딩을 통한 의미 표현과 픽셀 표현의 조화
Med-Banana-50K: 텍스트 유도 의료 영상 편집을 위한 크로스모달리티 대규모 데이터셋
Kascade: 긴 컨텍스트 LLM 추론을 위한 실용적인 희소 어텐션 방법
GLM-4.5: 에이전트, 추론 및 코딩(ARC) 기반 모델
GroundingME: 다차원 평가를 통한 MLLM의 시각적 기반 갭 노출
의미론과 재구성 모두 중요하다: 텍스트-to-이미지 생성 및 편집을 위한 표현 인코더 준비하기