Command Palette
Search for a command to run...
论文
每日更新的前沿人工智能研究论文,帮助您紧跟最新的人工智能趋势
篇论文

EnvACE:通过世界预演内化环境动态以实现智能体强化学习

GST-Bench:视觉语言模型能否从视频中形成全局空间感知?






























WorldClaw:面向大规模智能体式三维开放世界生成
可解释的感知语音 MEG 解码:皮层源与驱动检索的刺激特征
OSReward:为跨平台计算机使用奖励模型建立标准化评估
AgentOPSD:面向智能体强化学习的递归自蒸馏方法
ACM:面向长周期任务的智能体上下文管理
面向实时腹腔镜手术导航的基于 AI 的单帧结构光深度重建
浅层深度下基于共享经典随机性的酉与信道量子生成模型表示分离
奖励结构塑造了强化学习中情景探索与神经记忆之间的交互
稳定密度脊:子空间约束均值漂移的一致性及收敛性
面向隐私保护的课堂事件识别:鲁棒且高效的运动推理方法
ABSeeker:基于答案回溯信用分配的长程搜索智能体训练方法
PG-LLM:面向蛋白质变体排序的通用语言模型基准评测
DataSpace:面向异构工作空间可验证分析的 Data Agent 基准评测
策略滞后下的轨迹复用:面向大语言模型强化学习的前缀归一化策略优化
Harness-R1:从智能体失败轨迹中学习编辑可执行运行时 Harness
FinanceHarness:自主式金融深度研究框架
DeepSeek-V4:迈向高效百万 Token 上下文智能
知识–几何解耦:面向流式推荐的可刷新预训练迁移
Video-DeepResearch:迈向下一代多模态深度研究智能体
AURORA-LM:面向连续潜变量扩散语言模型的自编码统一表示
Hunyuan3D-Buffalo 1.0:面向可扩展 3D 生成、理解与编辑的统一多模态模型
JoyAI-Video-Edit:基于自回归扩散的实时开放式视频编辑
MerchantBench:面向电商运营中长期连贯性的 LLM 智能体基准测试
训练 nGPT
UEmbed:统一稀疏与稠密多模态嵌入
VAD:多模态同策略蒸馏中面向目标重构的视觉证据归因
基于强化学习的渐进式智能体技能生成方法
DAPD:双锚定策略蒸馏
LongHorizon-Harness:面向真实世界任务的长程智能体推进
SwanTale:面向指令与零样本任务的统一多说话人语音及音频生成模型