
CVPR 2026 世界模型论文全景梳理:从生成到建模的关键转变
在过去几年中,视频生成技术取得了令人瞩目的进展。从基于扩散模型的方法到大规模视频基础模型,生成结果在视觉质量上已经逐渐逼近真实世界。然而,当我们进一步审视这些模型时,一个更本质的问题开始显现:它们究竟是在“理解世界”,还是仅仅在“拟合像素分布”? 传统视频生成方法大多建立在 2D...
国内 AI 热点新闻
这里直接汇总国内 AI 圈、科技圈的热点新闻,优先看最新动态、模型发布、公司动作和行业变化。
不用先翻一圈媒体站,先在这里看当天值得跟进的内容。
已收录资讯
47,183
正文图片
150,967
查看 47183 条资讯

在过去几年中,视频生成技术取得了令人瞩目的进展。从基于扩散模型的方法到大规模视频基础模型,生成结果在视觉质量上已经逐渐逼近真实世界。然而,当我们进一步审视这些模型时,一个更本质的问题开始显现:它们究竟是在“理解世界”,还是仅仅在“拟合像素分布”? 传统视频生成方法大多建立在 2D...

2026年4月19日,第二届北京亦庄人形机器人半程马拉松赛事圆满落幕。多台搭载进迭时空 RISC-V AI CPU K3 芯片的「灵龙 2.0」人形机器人顺利完赛。「灵龙 2.0」是上海国家地方共建人形机器人创新中心开发的人形机器人平台。 在长距离、高负载、强实时的极限场景中,K...
4 月 20 日,SpaceX 尘封已久的 S-1 IPO 招股书正式对外披露。 这家瞄准 1.75 万亿美元超高估值,计划募资 750 亿美元冲击史上最大 IPO 的公司,眼下格外引人注目。要知道,现在美股市场整体难称得上景气,SpaceX 自己还在持续大额亏损,却敢逆势冲纳斯...
01、裁员背后的残酷逻辑:AI效率革命与资本算计 "AI带来的效率提升十分明显,原本需三天完成的任务如今半天即可完成;新人进组后,原本前三个月难以开展工作,现在一周就能上手。"前Meta技术总监Gen对雷峰网时如此描述。 但效率提升的背后,是扎克伯格冷酷的资本算计。2026年,M...
“现在,和Skill协作成了我们的日常工作,但公司里也没见谁‘被Skill替代’而被裁呀。” 一家跨境电商的运营赵磊向雷峰网吐槽道,语气里有点无奈,又藏着点庆幸。 在他看来,前段时间网上热议的“蒸馏同事”、“Skill替代打工人”更像是AI浪潮冲过来时,引发的下意识恐慌,但大家慌...

你可能遇到过这样一种情况,一个模型原本只做一件事的时候表现很好,但一旦不断往里面加新任务,它反而开始变差了。不是彻底失效,而是变得不稳定,有些能力开始下降,有些结果开始波动。问题不在于模型不会,而在于它原本会的东西,被后来加入的任务“挤掉了一部分”。 这背后其实有一个很少被说清楚...

4月19日,2026年北京亦庄半程马拉松暨人形机器人半程马拉松正式鸣枪开跑,搭载华科冷芯高速悬浮泵的荣耀人形机器人“闪电”凭借50分26秒(净用时)的成绩(人类半程马拉松世界纪录为56分42秒)获得冠军。而在此前4月11日晚的半程马拉松全流程测试中,荣耀人形机器人“闪电”机也...

美国医学与生物工程院(American Institute for Medical and Biological Engineering,简称AIMBE)近日公布2026届 Fellow 入选名单,蚂蚁集团技术研究院副院长,蚂蚁健康医疗AI实验室主任吕乐博士当选。 据AIMBE官...

一、研究背景 从视频中准确理解并重建人体3D运动是计算机视觉的重要研究方向,在体育赛事分析、VR/AR、人机交互以及医疗康复等领域具有广泛应用价值。然而,在真实复杂场景中,该任务仍面临三大严峻挑战: 首先是身份关联不稳定——多人交互时,频繁的遮挡和快速运动容易导致ID Switc...

如果回看过去十年的计算机视觉发展,其主线其实非常清晰:从早期以 ImageNet classification 为代表的“识别范式”,到以检测、分割为核心的“结构理解”,再到扩散模型推动的“生成范式”,视觉研究始终围绕一个核心目标展开——让机器更准确地“看见世界”。 然而,这一路...

5 月 7 日, 无问芯穹宣布此前已再获超 7 亿元融资,持续稳居中国 AI 原生基础设施公司融资规模之首。 联合领投方为杭州高新金投集团和惠远资本,跟投方包括国兴资本、秦淮数据、广发乾和、力合清瞳、中保投资、AEF NextGen、腾瑞资本、卡莱特、中信建投资本和宽德智能学习实...

如果把近几年计算机视觉的发展放在一个更长的时间尺度上去看,会发现整个领域其实一直在沿着一条非常明确但也非常受限的路径前进: 研究者不断把模型做得更大,把训练数据堆得更多,把单项 benchmark 指标推得更高,于是无论是分割、重建还是生成,模型在标准任务上的表现都在持续逼近“看...

很多人在使用文生图工具时都会遇到类似的情况,输入一段很清晰的描述,希望画面中人物站在左边、动物在右边,或者希望海报上出现一段完整可读的文字,但生成结果却常常让人失望。 要么位置关系混乱,要么文字变形,要么整体画面看起来不自然。继续调整参数,有时结果会更接近描述,但画面质量却明显下...

过去几年,视觉生成与视觉理解领域的技术推进,整体上始终沿着一条相对明确的路径展开:当一套建模范式被验证有效之后,后续的大量工作往往都会围绕这套既有框架持续做模型扩容、训练增强、采样优化与局部模块修补,以此换取更高的性能上限。 无论是扩散生成、视频 world model,还是动作...

在过去两年的大模型工业化进程中,安全审计始终遵循着一套 “猫鼠游戏” 的默认设定:开发者微调模型以增强能力,而安全专家则通过红队测试(Red Teaming)或白盒探测来寻找潜在的 “后门” 或 “偏见”。这套逻辑的前提是:模型是一个被动的受访者,它的行为必须由外部观测者通过穷举...

近日,国内多模态生成式人工智能公司智象未来(HiDream.ai)宣布完成超5亿元新一轮融资。本轮融资由东方富海、安徽省投资集团旗下的省产业投资公司、峰华资本等新股东联合投资,同时合肥产投、兴泰集团、合肥高投、安徽省人工智能母基金等老股东持续加注。 本轮融资将主要用于智象独创的下...

3D 视觉正从重建生成,走向空间理解、动态模拟与工程化应用。 作者丨郑佳美 编辑丨岑 峰 如果说过去几年的视觉 AI 主要是在回答“模型能不能看懂一张图”,那么到 CVPR 2026,一个更清晰的趋势正在浮现: 模型正在被要求理解图像背后的三维世界。 二维图像只是现实世界在某个视...

01 Anthropic豪掷2千亿美元锁定谷歌云 在硅谷,2千亿美元能买到什么?换算成现金,它能买下整整两个英特尔;换算成算力,人类历史上最昂贵的一份“芯片租赁合同”即将诞生。 2026年5月5日,据The Information报道,AI初创公司Anthropic已承诺在未来五...

感谢IT之家网友 風見暉一 、 HavokPro 的线索投递! IT之家 5 月 12 日消息,宇树科技今日发布 GD01 载人变形机甲, 390 万元起 。 官方表示,这是全球首款量产版载人机甲,还可以变形,民用交通工具,体重约 500kg(载人后)。 据IT之家上周报道,宇树...

IT之家 5 月 12 日消息,据央视新闻今日报道, 全国首例 AI 代写“种草笔记”案宣判 ,为“数字泔水”治理划红线。 近期,网络上出现了一批“一键生成爆款种草笔记”的 AI 写作工具,这些工具以极低的成本,批量炮制虚假消费体验和商品推荐。 近日,中央网信办部署开展“清朗 ·...