Command Palette
Search for a command to run...
论文
每日更新的前沿人工智能研究论文,帮助您紧跟最新的人工智能趋势
篇论文

TLive-Omni:面向电商直播的全模态理解模型

通过概念缩放与密集监督释放图像编辑潜力






























EchoWM:开放可进入的全模态世界模型
Apodex 1.1:面向复杂工作的智能体能力规模化扩展
EviRank:面向多模态图像重排序的结构化相关性证据
硬币皆有正反面:论大语言模型在策略蒸馏中泛化能力的双重性
InfinityEdit:基于轻量级编辑激活适配器的无限视频编辑
OmniAssistBench:面向全模态大语言模型的助手式交互评测基准
LLM 智能体时代的图工程:从个体智能到系统智能
逐步扩展:面向大规模混合专家模型的计算高效超参数迁移
AVO:面向自主进化搜索的智能体变异算子
MemTrapBench:评测大语言模型记忆使用中的认知陷阱
WithEveryone:面向群组图像生成的统一规划与身份锚定框架
SWE-bench Science:编程智能体能否解决科学领域的工程任务?
4DAnyone:从日常单目视频中创建任意人物的 4D 模型
FACET:在终端任务合成中保留源意图与可执行状态
EnvHarness:唤醒静态世界以赋能智能体学习
视觉生成中文本条件化的缩放性质
DifusionGemma 技术报告
ChartGalaxy:面向信息图理解与生成的数据集
用于交通监控视频中事故检测、定位与分类的模块化零样本流水线
SPADE ♠:自适应合成可执行环境中的自博弈
Co-RL:多智能体强化学习中多样化队列催生无监督推理能力
OmniScientist:一个全模态、全学科的 AI 科学家
SemaPLC:面向 PLC 代码生成的项目锚定、验证门控智能体框架
Zetta:面向自进化物理智能的高效闭环具身框架
SemComp-Bench:视频生成中语义任务完成的基准评测
Agentopia:智能体社会中的长期生活模拟与学习
MARCH:利用内容路由状态锚扩展循环记忆
GAN-BERT:利用少量标注样本进行鲁棒文本分类的生成对抗学习
Full-Duplex-Bench-v3:在真实非流利语音下评测全双工语音智能体的工具使用能力
AVA-Encoder:迈向智能体原生视频表示学习