Command Palette
Search for a command to run...
Papers
최신 AI 트렌드를 파악할 수 있도록 매일 업데이트되는 최첨단 AI 연구 논문
개의 논문

Fara-1.5: 컴퓨터 사용 에이전트를 위한 확장 가능한 학습 환경

Docling 기술 보고서






























고처리량 평가에서 습식 실험 연구까지: 검색 증강 모델을 통한 돌연변이 효과 예측의 진보
모델인가, 하네스인가? 에이전트 실패 원인 규명을 위한 상호작용 중심 분류 체계
언어 모델이 자신의 의식을 주장하도록 유도하면 인간의 신념과 가치가 회복된다
Diamond: 신경망 오디오 코덱 토큰에 대한 자기회귀 RQ-트랜스포머 기반 음성 복원용 시퀀스-투-시퀀스 모델
N0-TWAM: 접촉 중심 조작을 위한 촉각 기반 세계-행동 모델의 확장
AISPA: 대규모 언어 모델 애플리케이션을 위한 사용자 중심 시스템 프롬프트 감사
정신 세계 모델링
Meshy T2: 흐름 매칭을 이용한 고속 네이티브 메시 생성
N0-VTLA: 잠재 촉각 토큰을 활용한 시각-촉각-언어-행동 모델의 확장
RLVR에서 RLSVR로: 개방형 LLM 자기 개선을 위한 과제 변환 기반 자기 검증 보상 유도
BEACON: 에이전트 기반 시각 추론의 시기와 방법을 학습하는 모델
SkillSmith: 파라메트릭 스킬과 텍스트 지식의 합성 학습
VideoCoCo: 물리적으로 일관된 비디오 생성을 위한 에이전트 기반 이중 엔진 시스템에서의 사고 연쇄로서의 코드
PHIZERO: 물리 언어를 중심으로 구축된 세계 모델
Frontis-MA1: 기계 학습 엔지니어링에서 재귀적 자기 개선을 위한 AI4AI 모델 훈련
Metis: 메모리 기반 모델
Qwen-UI-Agent 기술 보고서: 차세대 실세계 중심 기반 GUI 에이전트를 향하여
AskChem: 화학 문헌 합성을 위한 주장 중심 인프라
하네스를 하네스로 만드는 것: 에이전트 하네스의 필요충분조건
OPENFORGE RL: 모든 환경에서 하네스 네이티브 에이전트 훈련
추론하며 예측하라: 공동 에이전트-추론기 강화 학습을 통한 에이전트의 다음 도구 호출 예측 학습
Pangram 4 기술 보고서
AI 에이전트는 개방형 AI 연구를 수행할 수 있는가? 두 건의 사례 연구에서 얻은 초기 증거
코드 기반 에이전트 하네스: 실행 가능하고 검증 가능하며 상태를 유지하는 에이전트 시스템을 향하여
CAST: LLM 에이전트를 위한 턴 단위 교사로서의 게임 솔버
CLBench-V: 그라운딩에서 지식 습득까지의 멀티모달 맥락 학습 평가
DecoEvo: 텍스트 공간에서의 점수 분리형 해결사-평가 기준 생성기 기술 공진화
HumanCLAW: 시각-언어 모델은 신체를 통해 행동할 수 있는가?
CoRT: 토큰 수준 루브릭 기반 정책 최적화를 위한 반사실 재생
TurboVLA: RTX 4090에서 32Hz로 구동되는 1GB 미만 VRAM의 실시간 비전-언어-행동 모델