Command Palette
Search for a command to run...
论文
每日更新的前沿人工智能研究论文,帮助您紧跟最新的人工智能趋势
篇论文

Wan-Streamer v0.2:更高分辨率,相同延迟

EVA-Client:面向真实机器人部署、评估与数据采集的统一框架






























GigaWorld-1:构建面向机器人策略评估的世界模型路线图
ResearchStudio-Idea:基于机器学习会议成果的证据驱动研究构思技能套件
ResearchStudio-Reel:打通从论文到海报、视频和博客的科研传播最后一公里自动化
FINAL Bench:评估大语言模型的功能性元认知推理能力
SceneFun3D:三维场景中的细粒度功能与可供性理解
TheoremGraph:桥接形式化与非形式化数学
始终在线智能体:大语言模型智能体的持久记忆、状态与治理综述
守护AI智能体:面向多层智能体红队测试的统一框架
DataComp-VLM:面向视觉语言模型的改进开放数据集
OrbitQuant:面向图像与视频扩散Transformer的数据无关量化方法
VLA-Corrector:面向自适应动作视野的轻量级检测与修正推理框架
Embodied.cpp:面向异构机器人的具身AI模型可移植推理运行时
优化训练策略的幻象:单调推理策略——大语言模型强化学习的真正目标
GeneBench-Pro:评估基因组学、定量生物学与转化生物医学中的多阶段统计推理
立场:AI/ML深度伪造研究与AI生成的非自愿亲密影像(AIG-NCII)存在错位
理解Grokking:岭回归中可证明的Grokking现象
扩散模型一致性的随机矩阵理论视角
语言模型记忆了多少?
混淆图集:用欺骗探针映射RLVR中诚实的涌现位置
立场:对齐社区正在无意间构建审查工具包
扩散模型与对数凹分布的高精度采样
AgenticDataBench:面向数据智能体的综合评测基准
多分辨率流匹配:通过分阶段采样实现无需训练的扩散加速
跃变为混合注意力模型
EvoPolicyGym:评估交互式环境中的自主策略演化能力
AgenticSTS:面向长周期LLM智能体的有界记忆测试平台
程序即权重:一种面向模糊函数的编程范式
MatAnyone 2:通过学习的质量评估器扩展视频抠图
EdgeTAM:端侧可追踪任意模型
PixelRefer:面向任意粒度的时空目标指称统一框架