Command Palette
Search for a command to run...
Papers
최신 AI 트렌드를 파악할 수 있도록 매일 업데이트되는 최첨단 AI 연구 논문
개의 논문

Gemma 4 기술 보고서

UI-MOPD: 지속적 GUI 에이전트 학습을 위한 멀티 플랫폼 온폴리시 증류






























Wan-Streamer v0.2: 더 높은 해상도, 동일한 지연 시간
EVA-Client: 실제 로봇에서의 배포, 평가 및 데이터 수집을 위한 통합 프레임워크
GigaWorld-1: 로봇 정책 평가를 위한 세계 모델 구축 로드맵
ResearchStudio-Idea: 머신러닝 학회 결과에 기반한 증거 중심 연구 아이디에이션 스킬 모음
ResearchStudio-Reel: 논문에서 포스터, 비디오, 블로그까지 연구의 마지막 단계 자동화
FINAL Bench: 대규모 언어 모델의 기능적 메타인지 추론 측정
SceneFun3D: 3D 장면의 세분화된 기능 및 어포던스 이해
TheoremGraph: 형식 수학과 비형식 수학의 연결
상시 작동 에이전트: LLM 에이전트의 지속적 메모리, 상태 및 거버넌스에 관한 조사
AI 에이전트 보안: 다계층 에이전트 레드팀 통합 프레임워크
DataComp-VLM: 비전-언어 모델을 위한 개선된 공개 데이터셋
OrbitQuant: 이미지 및 비디오 확산 트랜스포머를 위한 데이터 비의존적 양자화
VLA-Corrector: 적응형 행동 지평을 위한 경량 감지-및-수정 추론
Embodied.cpp: 이종 로봇에서의 체화된 AI 모델을 위한 포터블 추론 런타임
훈련 정책 최적화의 신기루: LLM 강화학습의 실제 목표로서의 단조적 추론 정책
GeneBench-Pro: 유전체학, 정량 생물학 및 중개 생의학에서의 다단계 통계적 추론 평가
입장: AI/ML 딥페이크 연구는 AI 생성 비동의 성적 이미지(AIG-NCII)와 정렬되지 않았다
그라킹의 이해: 릿지 회귀에서의 증명 가능한 그라킹
확산 모델의 일관성에 대한 랜덤 행렬 이론적 관점
언어 모델은 얼마나 많은 것을 암기하는가?
난독화 지도: 속임수 탐침으로 RLVR에서 정직이 출현하는 곳 지도화
입장: 정렬 커뮤니티가 의도치 않게 검열 도구 키트를 구축하고 있다
확산 모델 및 로그 오목 분포를 위한 고정밀 샘플링
AgenticDataBench: 데이터 에이전트를 위한 종합 벤치마크
다중 해상도 플로우 매칭: 단계적 샘플링을 통한 학습 없는 확산 가속
하이브리드 어텐션 모델로의 모핑
EvoPolicyGym: 대화형 환경에서의 자율 정책 진화 평가
AgenticSTS: 장기적 LLM 에이전트를 위한 제한된 메모리 테스트베드
Program-as-Weights: 퍼지 함수를 위한 프로그래밍 패러다임
MatAnyone 2: 학습된 품질 평가기를 통한 비디오 매팅의 확장