Command Palette
Search for a command to run...
Papers
최신 AI 트렌드를 파악할 수 있도록 매일 업데이트되는 최첨단 AI 연구 논문
개의 논문

DynamiCare: 상호작용적이고 개방형 의료 의사결정을 위한 동적 다중 에이전트 프레임워크

에너지 기반 트랜스포머는 확장 가능한 학습자이자 사고자입니다.






























IntFold: 일반적 및 특화된 생물분자 구조 예측을 위한 제어 가능한 기반 모델
내면의 목소리에 귀 기울이기: 중간 특성 피드백을 통한 ControlNet 훈련 조정
Skywork-Reward-V2: 인간-인공지능 협력을 통한 선호도 데이터 큐레이션의 확장
LangScene-X: TriMap 비디오 확산을 활용한 일반화 가능한 3D 언어 임베딩 장면 재구성
이미지를 활용한 다중모달 추론: 기초, 방법, 그리고 미래의 전망
WebSailor: 웹 에이전트를 위한 초인적 추론 탐색
AI 연구 에이전트를 위한 기계 학습: MLE-bench에서의 탐색, 탐사, 및 일반화
지역성 인식 병렬 디코딩을 이용한 효율적인 자기회귀 이미지 생성
FreeMorph: 확산 모델을 이용한 튜닝이 필요 없는 일반화된 이미지 변형
시각-언어-행동 모델에 대한 조사: 행동 토큰화의 관점
깊이: 어떤 조건에서도 모든 것
LongAnimation: 동적 전역-국소 메모리를 활용한 장기 애니메이션 생성
Kwai Keye-VL 기술 보고서
자율 주행을 위한 시각-언어-행동 모델에 대한 조사
MoCa: 모달리티 인식 연속 사전 학습이 더 나은 양방향 다중 모달 임베딩을 만듭니다
FreeLong++: 멀티밴드 스펙트럴 융합을 통한 트레이닝이 필요 없는 장시간 비디오 생성
토큰을 넘어서: 뇌에서 영감을 받은 지능에서 인공 일반 지능의 인지적 기초와 그 사회적 영향까지
수학적 추론이 일반 LLM 기능을 향상시키는가? LLM 추론의 전이성 이해
SciArena: 과학 문헌 작업을 위한 기초 모델 평가 플랫폼
의학에서의 통합적 인공지능: 성능 향상과 설명 가능성 개선
진화하는 맥락 내 프롬프트: 개방형, 자기 복제적 관점
SPIRAL: 제로섬 게임에서의 자기 대결이 다중 에이전트 다턴 강화 학습을 통해 추론을 유도함
VLMs에서 이미지 선호도를 위한 청자 보상형 사고
서예가: 자유형 텍스트 이미지 맞춤 설정
VMoBA: 비디오 확산 모델을 위한 블록 주의력 혼합
SMMILE: 다중 모드 의료 문맥 학습을 위한 전문가 주도 벤치마크
자동화된 LLM 스피드런 벤치마크: NanoGPT 개선 재현
Shape-for-Motion: 3D 프록시를 활용한 정밀하고 일관된 비디오 편집
이상에서 현실로: 실제 시나리오를 위한 통합적이고 데이터 효율적인 밀집 예측
ShotBench: 비전-언어 모델에서 전문가 수준의 시네마틱 이해