计算机视觉

搜索文档
4万多名作者挤破头,CVPR 2025官方揭秘三大爆款主题, 你卷对方向了吗?
机器之心· 2025-05-28 11:02
计算机视觉领域热门方向 - CVPR 2025基于全球4万多名作者的13008份投稿统计出三大热门方向 投稿数量同比增长13% 最终接收2878篇论文 接收率22.1% [3] - 研究群体呈现指数级增长趋势 AI领域重要性提升带动相关学位攻读人数增加 [3] 多视角与传感器3D技术 - 该方向投稿量激增 研究重点从单幅图像2D渲染转向复杂3D评估 2020年NeRF技术突破推动领域发展 [4][5] - 高斯泼溅(Gaussian splatting)技术进一步促进计算机视觉与图形学融合 神经渲染研究显著提升3D相关论文数量 [5] 图像与视频合成 - 成为CVPR 2025最大论文类别之一 多模态商业聊天机器人已实现图像/视频生成能力 正朝交互式世界生成演进 [6] - 会议展示的合成方法为生成完整虚拟环境奠定技术基础 [6] 多模态学习 - 视觉、语言和推理合并为投稿量最大类别之一 可能预示新研究趋势 [7][8] - CVPR坚持学术公平原则 每篇论文评审标准独立于作者机构背景 维护领域生态平衡 [8] 行业动态 - CVPR 2025会议即将召开 投稿竞争加剧反映AI研究热度持续攀升 [8] - 机器之心将同步举办论文分享会 提供学术交流平台 [8]
长春光机所光电突触器件研究取得新进展
环球网资讯· 2025-05-10 17:18
技术突破 - 长春光机所科研人员开发出紫外光电突触器件和光电突触晶体管,为人工视觉系统和神经形态计算视觉提供新技术路径 [1] - 紫外光电突触器件利用AlScN铁电极化特性和GaN光电性能,基于异质结处空穴俘获与解俘获机制构建 [1] - 光电突触晶体管通过气体吸附辅助持久光电导策略,实现紫外到近红外的宽谱高光电转换效率和长时数据保留能力 [1] 器件性能 - 紫外光电突触器件具备非易失性存储特性,可模拟生物视觉突触功能,实现多阻态调节如长时程增强(LTP)、对脉冲增强(PPF)等 [1] - 光电突触晶体管在375nm-1310nm宽谱范围内展现长时数据保留能力,双脉冲易化(PPF)指数达158% [2] - 器件在紫外到近红外波段展现出优异的光电探测性能 [2] 应用前景 - 器件成功模拟人眼视网膜细胞对多光谱信号的感知与识别功能,为多光谱神经形态视觉系统提供高效解决方案 [2] - 神经形态视觉系统模拟人脑神经元和突触结构,采用并行处理方式,可同时处理多路信息,降低功耗并提升数据处理速度 [2] - 计算机视觉是自动驾驶、智能机器人和智能制造等新兴领域的核心技术 [2]
CVPR 2025 | CV 微调卷出天际,Mona:我小、我强、我省资源
机器之心· 2025-05-01 10:11
代码地址: https://github.com/Leiyi-Hu/mona 合作单位包括清华、国科大、上海交大、阿里巴巴。本文第一作者为殷东硕,清华大学计算机系「 水木学者」博后,中科院博士,曾以一作身份在 Nature Communications、IEEE CVPR、IEEE ICCV、ACM MM、IEEE TITS 等国际期刊/会议发表论文,并任 NeurIPS、CVPR、ICCV、ICLR、IEEE TIP、 IEEE TMM 等会议期刊审稿人。曾获「 中国科学院院长奖」,并与微软亚洲研究院 MSRA 和阿里巴巴集团进行科研合作。研究方向包括计算机视觉、参数 高效微调、视频生成、多模态以及遥感图像解译等。 Mona (Multi-cognitive Visual Adapter)是一种新型视觉适配器微调方法,旨在 打破传统全参数微调(full fine-tuning)在视觉识别任务中的性能瓶颈 论文标题: 5%>100%: Breaking Performance Shackles of Full Fine-Tuning on Visual Recognition Tasks 论文地址: http ...
斯坦福大学:人工智能百年研究报告,2030年的人工智能与生活
欧米伽未来研究所2025· 2025-04-01 23:17
文章核心观点 - 斯坦福大学AI100项目首份报告《人工智能与生活2030》为审视未来十几年AI融入日常提供理性视角,AI虽有潜力带来积极影响,但也会带来社会、伦理和法律挑战,需制定政策引导其发展 [3][18] 百年之约:AI100项目的缘起与使命 - AI100项目源于对AI领域快速发展及其深远社会影响的认识,受2008 - 2009年AAAI组织的“阿西洛马会议”启发而生 [4] - 项目设立常设委员会,计划每五年组织专门研究小组评估AI,目标是为AI研究、开发、设计和政策制定提供指导,确保AI惠及个人与社会 [4] 首份报告研究小组及任务 - 首份报告研究小组由17位AI专家及多领域学者组成,背景多元确保研究广度与深度 [5] - 常设委员会要求研究小组聚焦AI到2030年对“典型的北美城市”生活的影响,选择城市和限定北美是为深入探讨特定背景影响并承认全球城市多样性 [5] 揭开AI的面纱:它是什么,不是什么 - AI是一门科学和计算技术,灵感源于人类神经系统和感知等方式,但运作方式与人类不同,精确定义AI有挑战 [6] - 当前AI在特定任务上进展显著,如深度学习、计算机视觉、自然语言处理、AI规划等,但并非“通用人工智能”,缺乏人类常识等能力,不会对人类构成迫在眉睫威胁,应期待其积极影响 [7][8] AI渗透八大领域:2030年城市生活图景 - 交通运输领域,到2030年自动驾驶汽车将更普遍,会改变城市面貌、缓解交通问题,但面临安全性和可靠性挑战,公众对AI的认知可能由此塑造 [9][11] - 家庭/服务机器人领域,未来十五年会出现更多特定用途机器人,但制造通用型机器人面临技术和成本障碍,近期商业机会集中在特定应用 [11] - 医疗健康领域,AI可利用健康数据进行疾病预测等,有望改善数百万人健康和生活质量,但从实验室到临床应用速度较慢,面临数据隐私等挑战 [11] - 教育领域,AI能为教育带来个性化变革,但设计有效AI系统面临挑战,需关注教育资源平等和内容准确性等问题,人机交互顺畅性和信任度是关键 [10] - 低资源社区领域,AI可帮助优化资源分配等,但应用设计可能忽略社区特殊需求或加剧不平等,确保技术普惠性和建立社区信任至关重要 [10] - 公共安全与安防领域,AI用于犯罪预测等引发隐私和偏见担忧,需在提升安全效率与保护公民权利间取得平衡,公众信任是基石 [12] - 就业与职场领域,AI会自动化部分工作冲击现有岗位,但也会创造新岗位和增强人类能力,社会需适应转变,克服人们对被边缘化的恐惧 [12] - 娱乐领域,AI已深度融入娱乐产业,未来会有更具交互性和沉浸感的形式,但可能带来社交隔离等社会风险 [12] 超越技术:AI的社会挑战与政策前瞻 - AI发展带来公平性与偏见、隐私、安全与可靠性、责任归属、经济影响与分配、人机关系等社会、伦理和法律挑战 [13][14] - 报告提出政策建议,包括提升政府AI专业能力、鼓励对AI社会影响的研究、避免对“AI”笼统监管、促进透明度和公众信任、关注公平与普惠 [14][15][17] 结语:面向2030的理性期待与责任 - 报告描绘了AI融入城市生活带来便利和挑战的未来图景,将讨论焦点拉回现实,提醒人们AI未来掌握在自己手中,需积极引导其发展 [18] - AI100项目才刚开始,当下应理解报告洞察与建议,塑造负责任、可持续、以人为本的AI未来 [18]
“计算机视觉被GPT-4o终结了”(狗头)
量子位· 2025-03-29 15:46
GPT-4o多模态图像生成技术突破 - GPT-4o原生多模态图像生成能力被开发出多种新玩法,包括将表情包转化为语义分割图和深度图[2][3][4] - 该技术对传统AI画图工具、设计师和计算机视觉研究领域产生颠覆性影响[6] - 在自动驾驶领域展现潜力,能识别特斯拉自动驾驶系统无法识别的伪装"隐形墙"[8] 技术实现路径争议 - 应用研究主管提出自动驾驶领域只需训练强大基础模型后微调即可实现[10] - 反对观点认为Stable Diffusion+ControlNet已具备同等能力[11] - 技术突破关键在于通过扩大基础模型规模实现意想不到的效果[12] 模型架构技术细节 - GPT-4o图像生成采用原生嵌入ChatGPT的自回归模型,与DALL·E的扩散模型不同[13][15] - 推测采用多尺度自回归组合技术,首先生成粗略图像再逐步填充细节[17] - 存在争议观点认为解码阶段可能仍使用扩散模型,参考Meta 24年8月论文提出的多模态模型同时预测token和扩散图像的方法[20][24] 行业活动信息 - 中国AIGC产业峰会将于4月16日在北京举行,汇聚百度、无问芯穹等AI领域企业[26]
【计算机】端侧AI发展迎来重大拐点,计算视觉领导者虹软科技有望实现新增长——AI行业跟踪报告第60期(刘凯/白玥)
光大证券研究· 2025-03-06 17:25
点击注册小程序 特别申明: 本订阅号中所涉及的证券研究信息由光大证券研究所编写,仅面向光大证券专业投资者客户,用作新媒体形势下研究 信息和研究观点的沟通交流。非光大证券专业投资者客户,请勿订阅、接收或使用本订阅号中的任何信息。本订阅号 难以设置访问权限,若给您造成不便,敬请谅解。光大证券研究所不会因关注、收到或阅读本订阅号推送内容而视相 关人员为光大证券的客户。 报告摘要 端侧 AI技术的快速发展正在推动多领域的智能化变革 风险提示: AI技术发展不及预期;AI眼镜落地不及预期;下游需求不及预期。 发布日期: 2025-03-06 根据WellsennXR数据,全球眼镜市场规模庞大,2023年销量约15.6亿副,市场规模约1500亿美元,预计未 来10年销量将达20亿副,市场规模接近2000亿美元。AI智能眼镜在这一背景下展现出巨大潜力,预计2025 年开始快速渗透传统眼镜市场,2035年销量有望达14亿副。目前,Meta、雷鸟、百度、Rokid等企业已推 出多款AI眼镜产品,推动技术迭代与市场成熟。截至2024Q2,Meta与雷朋联名产品Ray-BanMeta出货量已 经超过了100万台;雷鸟V3AI拍摄眼 ...
AI网红,24小时无休,年入7000万
创业邦· 2025-03-01 17:42
以下文章来源于乌鸦智能说 ,作者智能乌鸦 乌鸦智能说 . 人人都能读懂的AI商业 来 源丨乌鸦智能说(ID:wuyazhinengshuo) 作者丨朗朗 图源丨Midjourney 今天带你们见识下新时代的永动机——AI网红。 她们不会疲惫,永不塌房,还能24小时创造现金流,堪称资本家眼中完美的"打工人"。 当所有人还在摸索用AI赚钱的正确姿势,AI网红率先找到了专属的生态位: 从年入千万美元的顶奢代言,到OnlyFans上的AI分身代聊,再到小红书上AI猫狗博主靠"云养宠"狂揽品 牌商单…… 开发超过70产品的硅谷狂人Levelsio说,"AI网红现在正迅速成为一门大生意"。 预计到2030年,AI网红的市场规模将达到450亿美元。这几乎是现在网红市场的两倍。 各位打工人请系好安全带,今天我们要解剖这个赛博奇观:一群不会呼吸的电子生命体,正在用代码重 构"劳动"的定义。 从时尚博主到AI分身 解锁AI网红赚钱姿势 当大部分AI初创公司还在摸索商业模式,AI网红的变现方式早已五花八门:不仅有品牌代言与联名、情 感经济与订阅服务、还有数字资产衍生产品等等。 接下来,就跟着乌鸦君一起来看看吧。 1、时尚、颜值博主 ...
云天励飞:云天励飞首次公开发行股票并在科创板上市招股意向书
2023-03-15 19:31
Ie 1、n 本次股票发行后拟在科创板市场上市,该市场具有较高的投资风险。科 创板公司具有研发投入大、经营风险高、业绩不稳定、退市风险高等特点, 投资者面临较大的市场风险。投资者应充分了解科创板市场的投资风险及本 公司所披露的风险因素,审慎作出投资决定。 深圳云天励飞技术股份有限公司 (深圳市龙岗区园山街道龙岗大道 8288 号深圳大运软件小镇 36 栋 4 楼) 首次公开发行股票并在科创板上市 招股意向书 保荐人(主承销商) (广东省深圳市福田区中心三路 8 号卓越时代广场(二期)北座) 联席主承销商 (北京市朝阳区安立路 66 号 4 号楼) 副主承销商 (广东省广州市黄埔区中新广州知识城腾飞一街 2 号 618 室) 深圳云天励飞技术股份有限公司 招股意向书 发行人声明 发行人及全体董事、监事、高级管理人员承诺招股意向书及其他信息披露 资料不存在虚假记载、误导性陈述或重大遗漏,并对其真实性、准确性、完整 性承担个别和连带的法律责任。 发行人控股股东、实际控制人承诺本招股意向书不存在虚假记载、误导性 陈述或重大遗漏,并对其真实性、准确性、完整性承担个别和连带的法律责 任。 公司负责人和主管会计工作的负责人 ...