全球「AI学术顶会」精华汇聚地
您正在使用IE低版浏览器,为了您的雷峰网账号安全和更好的产品体验,强烈建议使用更快更安全的浏览器
雷峰网
  • 雷峰网公开课
  • 活动中心
  • GAIR
  • 专题
  • 爱搞机
  • 业界
  • 人工智能
    学术 开发者
  • 智能驾驶
  • 数智化
    零售数智化 金融数智化 工业数智化 医疗数智化 城市数智化
  • 金融科技
    科技巨头 银行AI 金融云 风控与安全
  • 医疗科技
    医疗AI 投融资 医疗器械 互联网医疗 生物医药 健康险
  • 芯片
  • 政企安全
  • 智慧城市
    智慧安防 智慧教育 智慧交通 智慧社区 智慧零售 智慧政务 智慧地产
  • 行业云
  • 工业互联网
    工业软件 工业安全 5G工业互联网 工业转型实践
  • AIoT
    物联网 智能硬件 机器人 智能家居
  • CVPR 计算机视觉与模式识别会议

    CVPR (计算机视觉与模式识别会议)是计算机视觉领域公认的顶级会议,我们聚焦其中的图像理解、三维重建、生成模型与底层视觉等核心议题。在这里,我们以精简、客观的方式梳理论文脉络,为视觉领域的研究者与从业者提供一份可靠的技术索引。
热门论文 热门议题 高校表现 企业表现 过往报道
人工智能

CVPR 2026 Oral|告别模型合并冲突!南大等提出OrthoReg:极简正交正则化,揭开任务算术的底层机制

竟是预训练模型的什么内在属性,或者任务向量的什么特征,促成了这种解耦?
 陈淑瑜 2026/05/29 10:57
人工智能

CVPR 2026|视频虚拟试穿新 SOTA!KeyTailor 虚拟换衣告别假质感,15K 高清数据集 ViT-HD 已经开源。

026 年 CVPR 最新接收的 KeyTailor,用一套关键帧驱动细节注入方案,不改动 DiT 主干、不加参、不降速,直接把服装动态细节、背景帧间一致性拉满
 陈淑瑜 2026/05/29 10:53
人工智能

CVPR 2026 | 1000万段驾驶视频,教会模型如何估计相机位姿

不用百万级 3D 标注,模型也能从普通驾驶视频中学会「自己是怎么动的」。Wayve 的 LA-Pose 试图把未标注视频里的运动信号,转化为自动驾驶系统所需的相
 陈淑瑜 2026/05/29 10:40
人工智能

文献分享 | CVPR 2026 | Ultrasound-CLIP:让视觉-语言模型真正读懂超声图像与报告

对于超声这类高度依赖专业知识和细粒度属性判断的医学影像任务,将领域知识、诊断结构和语义关系显式融入预训练过程,是提升模型临床理解能力的重要方向。
 陈淑瑜 2026/05/28 18:05
人工智能

CVPR'26重磅 | 港科大沈劭劼团队&华为DLWM:告别3D标注,3DGS双世界模型革新自动驾驶

DLWM在3D占用检测、4D占用预测以及运动规划等方面都取得了显著的性能提升。
 陈淑瑜 2026/05/28 15:12
人工智能

CVPR'26开源 | Adobe新作DAGE:高效细粒度的深度估计+姿态估计,三维重建新SOTA!

DAGE能够生成清晰的深度/点云图、强大的跨视图一致性以及精确的姿态信息,为视频几何结构和多视图重建领域带来了新的最佳成果。
 陈淑瑜 2026/05/28 14:55
人工智能

CVPR 2026 Oral | 牛津 & Meta AI 推出 VGGT-Ω:前馈 3D 重建迈入 10B 参数时代,动态场景精度升 77%

VGGT-Ω通过一套精妙的架构改进,实现了对动态场景的高精度重建,在 Sintel 等极具挑战性的基准测试中,将相机估计精度足足提升了 77%。
 陈淑瑜 2026/05/28 14:50
人工智能

GAIR Paper 091:CVPR 2026 三维视觉趋势梳理:从 RGB 感知,到真实世界建模

多视角、事件视觉与相机轨迹,共同推动视觉模型走向更强空间推理。
 郑佳美 2026/05/28 11:47
人工智能

GAIR Paper 090:CVPR 2026 医学影像 AI 趋势梳理:从看懂影像,到接管科研工作流

模型正从影像识别走向高效适配、临床语义理解与跨模态推理。
 郑佳美 2026/05/28 11:46
人工智能

CVPR 2026 | 多模态大模型对视觉差异不敏感?深圳大学最新研究提出OddGridBench:一个细粒度视觉差异识别评测基准

OddGridBench:揭示多模态大语言模型缺乏细粒度视觉差异敏感性
 陈淑瑜 2026/05/28 11:38
人工智能

CVPR 2026|用互联网视频替代3D标注:通研院团队打造SceneVerse++「最大规模」真实3D场景数据

当高质量 3D 标注数据日益稀缺,我们能否用「海量」互联网视频构建高精度、可扩展的真实场景数据,提升 3D 场景理解的多任务表现?
 陈淑瑜 2026/05/28 10:57
人工智能

CVPR2026 | 极少数据训练的通用目标检测模型, 无需提示跨域泛化, 遥感数据表现优异!

无需任何文本或视觉提示的通用区域候选网络PF-RPN,通过可学习视觉嵌入替代文本嵌入实现开放世界目标定位
 陈淑瑜 2026/05/28 10:46
人工智能

CVPR 2026 | 突破短视,理解变化!HiF-VLA:以motion为中心打造「边想边做」的世界动作模型

HiF-VLA 巧妙提取低维紧凑的 Motion 向量作为动态先验,在一个创新的「联合专家」模块中,同步完成未来视觉运动的预测与高精度动作序列的生成。
 陈淑瑜 2026/05/27 18:22
人工智能

CVPR 2026 | DocHumming:面向真实场景的端到端文档解析新范式

论文聚焦"如何让端到端文档解析模型在真实随拍场景下保持鲁棒性"这一核心问题,提出了端到端文档解析模型 DocHumming
 陈淑瑜 2026/05/27 18:16
人工智能

CVPR 2026 | 从生成式压缩到3D空间智能,七项前沿突破洞悉计算机视觉未来方向

GVC1D利用视觉Transformer将视频编码为极紧凑的一维潜在标记,打破二维网格的刚性空间对应关系,有效减少帧内冗余并实现 token 数量的自适应缩减。
 陈淑瑜 2026/05/27 18:08
123456...8
热门文章
  • 200万现金冠军奖+最高500万投资,一家 VC 为 AI 创业者造了一座「乌托邦」
    200万现金冠军奖+最高500万投资,一家 VC 为 AI 创业者造了一座「乌托邦」
  • Agent 走向具身世界:从语言智能到机器人「大脑指挥官」
    Agent 走向具身世界:从语言智能到机器人「大脑指挥官」
  • 机器人首秀网球场,银河通用突破具身智能「AstraTennis时刻」
    机器人首秀网球场,银河通用突破具身智能「AstraTennis时刻」
  • WRC 2026 风向标:具身智能下半场,比「大脑」更比「账本」
    WRC 2026 风向标:具身智能下半场,比「大脑」更比「账本」
  • 国内第一视角数据最早押注者,北大卢宗青:隐空间才是具身的路
    国内第一视角数据最早押注者,北大卢宗青:隐空间才是具身的路
联系我们 关于我们 意见反馈

下载雷峰网客户端

iPhone Android

Copyright © 2011-2026 雷峰网 深圳英鹏信息技术股份有限公司 版权所有 粤ICP备11095991号     办公电话 0755-26581864

请填写申请人资料
姓名
电话
邮箱
微信号
作品链接
个人简介
为了您的账户安全,请验证邮箱
您的邮箱还未验证,完成可获20积分哟!

重发邮箱修改邮箱

请验证您的邮箱
立即验证
完善账号信息
您的账号已经绑定,现在您可以设置密码以方便用邮箱登录
立即设置 以后再说