全球「AI学术顶会」精华汇聚地
您正在使用IE低版浏览器,为了您的雷峰网账号安全和更好的产品体验,强烈建议使用更快更安全的浏览器
雷峰网
  • 雷峰网公开课
  • 活动中心
  • GAIR
  • 专题
  • 爱搞机
  • 业界
  • 人工智能
    学术 开发者
  • 智能驾驶
  • 数智化
    零售数智化 金融数智化 工业数智化 医疗数智化 城市数智化
  • 金融科技
    科技巨头 银行AI 金融云 风控与安全
  • 医疗科技
    医疗AI 投融资 医疗器械 互联网医疗 生物医药 健康险
  • 芯片
  • 政企安全
  • 智慧城市
    智慧安防 智慧教育 智慧交通 智慧社区 智慧零售 智慧政务 智慧地产
  • 行业云
  • 工业互联网
    工业软件 工业安全 5G工业互联网 工业转型实践
  • AIoT
    物联网 智能硬件 机器人 智能家居
  • CVPR 计算机视觉与模式识别会议

    CVPR (计算机视觉与模式识别会议)是计算机视觉领域公认的顶级会议,我们聚焦其中的图像理解、三维重建、生成模型与底层视觉等核心议题。在这里,我们以精简、客观的方式梳理论文脉络,为视觉领域的研究者与从业者提供一份可靠的技术索引。
热门论文 热门议题 高校表现 企业表现 过往报道
人工智能

CVPR 2026 Highlight|让AI像电影人一样「看」视频,8B小模型反超GPT-5与Gemini-3.1-Pro

由 CMU 联合哈佛大学组成的研究团队推出了 CHAI(Critique-based Human-AI Oversight),一整套从「标注体系」「可扩展监督」
 陈淑瑜 2026/06/02 17:13
人工智能

炸场CVPR 2026!再读5篇顶会论文 — 3D重建/自动驾驶/视频抠像全突破

读懂这些突破性技术背后的思考,真切体会到这些研究者正实实在在推动视觉AI从“看起来像”走向“真的能用”。
 陈淑瑜 2026/06/02 17:02
人工智能

CVPR 2026 | 生成1024高清图,只需要16个Token?基于代理去噪的扩散模型加速框架

只让少量“代理 token”真实去噪,再用它们的残差变化带动其他token模拟去噪。
 陈淑瑜 2026/06/02 16:57
人工智能

CVPR-2026 | 实现无人机 / 街景 / 卫星全视角自由匹配!GeoBridge:多视图模型助力无人机精准地理定位

GeoBridge语义锚定多视图基础模型,跳出卫星中心固有范式,实现无人机、街景全景、卫星影像全视角双向匹配,还支持自然语言→地理图像跨模态检索。
 陈淑瑜 2026/06/01 17:37
人工智能

CVPR 2026 | MOGeo:跨视角多目标地理定位技术

MOGeo使得跨视角图像目标地理定位从单目标地理定位到更符合实际需求的多目标地理定位。
 陈淑瑜 2026/06/01 17:18
人工智能

CVPR 2026 Oral|Google × TUM:LILA 想让每个像素都有自己的时空特征

LILA 盯的是一个很基础、但常常被绕开的点:视觉 foundation model 很强,但很多输出仍然是 patch-level feature。
 陈淑瑜 2026/06/01 15:41
人工智能

CVPR26开源 | ClipGStream:首个同时支持大运动和长序列的4D重建框架,动态高斯重建新SOTA

ClipGStream一种全新的 Clip-Stream 混合动态重建框架,首次在统一框架中同时解决了长序列建模与大尺度运动重建难题。
 陈淑瑜 2026/06/01 15:17
人工智能

CVPR 2026 Oral 最佳论文候选 | 浙大&蚂蚁提出 HTD-Refine:对齐高阶动力学,让单目人体动作恢复告别“滑步”与“抖动”

通过显式地预测并对齐这些高阶动力学特征,HTD-Refine 成功让单目视频恢复出的动作变得既丝滑又真实。
 陈淑瑜 2026/06/01 15:13
人工智能

CVPR 2026|不用 fine-tuning,也不用 SAM,DINOv3 能直接学会分割吗?INSID3 平均高 7.5 个点

INSID3 的分量在于,它不是只在一个 benchmark 上赢,而是在 semantic、part、personalized 三类任务里都把单 backbo
 陈淑瑜 2026/06/01 15:07
人工智能

CVPR 26 | Waymo把行车记录仪变成自动驾驶传感器:长尾数据终于能进仿真了

 Waymo 提出 Sensor2Sensor ,用 4D Gaussian Splatting 先把自家自动驾驶日志渲染成“行车记录仪视角”,再训练扩散模型把
 陈淑瑜 2026/06/01 14:43
人工智能

CVPR-2026 Highlight | 机器人如何“知之为知之”!AbstainEQA:具身问答弃权能力基准重磅发布

南洋理工大学MARS Lab与NPL Lab联合打造首个具身问答弃权基准AbstainEQA,实测发现顶尖模型弃权能力仅达人类47%,为安全人机交互划定全新标准
 陈淑瑜 2026/05/29 17:35
人工智能

【CVPR 2026】自-交叉注意力SCA,兼顾自身依赖与跨分支交互的增强特征,即插即用!

ParTY:富有表现力的文本到动作合成的部分指南
 陈淑瑜 2026/05/29 16:28
人工智能

CVPR 2026 | 同济大学破解SNN追踪难题:SpikeTrack实现精度与能效双SOTA!

SpikeTrack不仅在SNN追踪器中达到了SOTA(目前最佳)水平,更在保证精度的前提下,将能耗降低至传统ANN追踪器的几十分之一。
 陈淑瑜 2026/05/29 16:23
人工智能学术

GAIR Paper 092:CVPR 2026 图像编辑趋势梳理:从参考一张图,到融合整个视觉世界

复杂视觉关系成为生成模型的新考题。
 郑佳美 2026/05/29 15:13
人工智能

研究成果|CVPR 2026 面向隐私约束跨域语义分割的风格自适应泛化框架

当模型内部不可访问时,如何提升冻结语义分割模型的跨域泛化能力
 陈淑瑜 2026/05/29 11:16
12345...8
热门文章
  • 200万现金冠军奖+最高500万投资,一家 VC 为 AI 创业者造了一座「乌托邦」
    200万现金冠军奖+最高500万投资,一家 VC 为 AI 创业者造了一座「乌托邦」
  • Agent 走向具身世界:从语言智能到机器人「大脑指挥官」
    Agent 走向具身世界:从语言智能到机器人「大脑指挥官」
  • 机器人首秀网球场,银河通用突破具身智能「AstraTennis时刻」
    机器人首秀网球场,银河通用突破具身智能「AstraTennis时刻」
  • WRC 2026 风向标:具身智能下半场,比「大脑」更比「账本」
    WRC 2026 风向标:具身智能下半场,比「大脑」更比「账本」
  • 国内第一视角数据最早押注者,北大卢宗青:隐空间才是具身的路
    国内第一视角数据最早押注者,北大卢宗青:隐空间才是具身的路
联系我们 关于我们 意见反馈

下载雷峰网客户端

iPhone Android

Copyright © 2011-2026 雷峰网 深圳英鹏信息技术股份有限公司 版权所有 粤ICP备11095991号     办公电话 0755-26581864

请填写申请人资料
姓名
电话
邮箱
微信号
作品链接
个人简介
为了您的账户安全,请验证邮箱
您的邮箱还未验证,完成可获20积分哟!

重发邮箱修改邮箱

请验证您的邮箱
立即验证
完善账号信息
您的账号已经绑定,现在您可以设置密码以方便用邮箱登录
立即设置 以后再说