Command Palette
Search for a command to run...
Papers
최신 AI 트렌드를 파악할 수 있도록 매일 업데이트되는 최첨단 AI 연구 논문
개의 논문

Skill Self-Play: 공진화하는 기술을 통한 LLM 역량의 한계 돌파

더 나은 하네스, 더 작은 모델: 자동화된 하네스 적응을 통한 90% 비용 절감형 에이전트 구축






























기억에서 기술로: 장기 수행 LLM 에이전트를 위한 증거 기반 공진화 거버넌스
문맥 가중 이산 흐름 매칭
SANA-Video 2.0: 효율적 비디오 생성을 위한 어텐션 잔차 기반 하이브리드 선형 어텐션
말하지 말고 보여줘: LLM 텍스트 대신 생성형 픽셀에서 공간 인지 평가하기
시각적 대조 자기 증류
ReferTrack: 지칭 후 추적 방식의 체화된 시각 추적
K12-KGraph: 교육용 대규모 언어 모델 벤치마킹 및 훈련을 위한 교육과정 정렬 지식 그래프
AREX: 심층 연구를 위한 재귀적 자기 개선 에이전트를 향하여
유클리드 클리핑을 넘어서: 리만 등거리 정책 최적화를 통한 LLM 강화학습의 탐색 붕괴 극복
대규모 언어 모델에서 하이퍼네트워크 기반 지식 주입을 위한 스케일링 법칙
능동적 관찰자를 위한 시험
적합성 중심 검색을 넘어서: 평가 기준 기반 문서 집합 선택 및 순위화
자기 기울기 강제: 네이티브 장기 비디오 외삽
SLAI T-Rex: Ascend SuperPOD 상에서의 DeepSeek-V4 계열 모델 전체 파라미터 사후 학습
Vera: 콘텐츠 보존형 비디오 편집을 위한 계층적 확산 모델
개방형 생성 평가를 위한 2단계 메타 루브릭: 사실적 완전성 벤치마크 GAMUT
자동 발견에는 보편적으로 우월한 하네스가 존재하지 않는다
에이전트 시스템 스케일링 과학을 향하여
AlayaWorld: 상호작용형 장기 지평 세계 모델링 - 전체 기술 보고서
Mage-Flow: 효율적인 원본 해상도 기반 이미지 생성 및 편집 기초 모델
DataFlow-Harness: 편집 가능한 LLM 데이터 파이프라인 구축을 위한 정박형 코드 에이전트 플랫폼
텍스트 템플릿 토큰은 확산 트랜스포머의 암묵적 의미 레지스터이다
플레이 속도로 동작하는 생성형 월드 렌더러
단일 데스크톱 GPU에서의 무한 인터랙티브 월드 롤아웃
UniMoMo: 신규 결합체 설계를 위한 3차원 분자 통합 생성 모델
대조적 신념 업데이트를 통한 보상 추구 행동 측정
LLM-as-a-Coach: 검증 불가능한 작업을 위한 경험적 학습
Apple-π: 물리 법칙 기반 추론 능력 평가를 위한 비디오 생성 모델 벤치마크
HOMIE: 다중 모드 지능형 향상을 통한 인간-객체 중심 비디오 개인화
SWE-Pruner Pro: 코더 LLM은 이미 무엇을 가지치기할지 알고 있다