Command Palette
Search for a command to run...
Papers
최신 AI 트렌드를 파악할 수 있도록 매일 업데이트되는 최첨단 AI 연구 논문
개의 논문

LLM의 의료 추론: DeepSeek R1에 대한 심층 분석

Speech-FT: 크로스 태스크 일반화를 위한 사전 학습 및 파인튜닝된 음성 표현 모델 병합






























DeepSeek LLM: 장기적 관점과 함께 오픈소스 언어 모델을 확장하기
MatterGen: 무기물 설계용 생성 모델
MultiActor-Audiobook: 다중 화자의 얼굴과 목소리를 활용한 제로샷 오디오북 생성
Phi-4 기술 보고서
LAMMPS 시뮬레이션 패키지를 위한 튜토리얼 모음
GLM-4-Voice: 지능적이고 인간과 유사한 엔드투엔드 음성 채팅 봇을 향해
영상 더빙을 위한 길이 인식 음성 번역
DrawingSpinUp: 단일 캐릭터 그림으로부터의 3D 애니메이션
음성 번역에서 음성 인식 오류 분석을 위한 음운론적 단어 오류 정렬
ReaderLM-v2: HTML을 Markdown 및 JSON으로 변환하기 위한 소형 언어 모델
실패 안전 자동차 플랫폼을 위한 배포 계산 및 분석
MegActor: 생생한 초상화 애니메이션을 위해 원본 비디오의 힘을 활용하다
Flash-VStream: 긴 비디오 스트림을 위한 메모리 기반 실시간 이해
PhotoMaker: 스택된 ID 임베딩을 통한 사실적인 인간 사진 사용자 정의
StoryDiffusion: 장거리 이미지 및 비디오 생성을 위한 일관된 셀프 어텐션
품질 추정과 시정 피드백을 활용한 체로키어-영어 기계 번역 데모
탄력성 없는 수요와 겉보기 전력 제약 조건이 있는 수요 반응에 대한 온라인 알고리즘
ESPnet-SDS: 대화형 음성 시스템을 위한 통합 툴킷 및 데모
Jais 및 Jais-chat: 아랍어 중심의 파운데이션 및 지시어 튜닝된 오픈 생성 대규모 언어 모델
비지도 기계 번역을 위한 빠른 역번역
EHR 기반 임상 연구를 위한 오픈 자연어 처리(NLP) 프레임워크: 국가 COVID 공동 연구 협력체(N3C)를 사용한 사례 실증
확산 기반 오디오 인페인팅
판옵틱 원클릭 분할: 농업 데이터에 적용
Hunyuan-Large: Tencent의 520억 활성화 파라미터를 가진 오픈소스 MoE 모델
SketchAgent: 언어 기반 순차적 스케치 생성
양자장의 게이지 이론 패러다임 내 중합효소 연쇄반응의 물리적 브리징 동역학
Microsoft Academic 자동 문서 검색: 학술지 논문에 대한 정확도와 인용 분석에 대한 적합성
OSS PESTO: 오픈 소스 소프트웨어 프로젝트 평가 및 선택 도구
정제된 서열을 사용하여 AlphaFold3로 상태 인식 단백질-리간드 복합체 예측
작지만 의미 있는: 접근 가능한 AIED를 위한 소형 언어 모델의 가능성에 관하여