非显而易见杯

专利无效挑战赛

目标专利:2056一种增强媒体记录的方法和系统

专利公开号:CN107534797B

专利权人:皇家KPN公司

无效请求书提交日期:2026年


上一项目 下一项目

非显而易见性评估仅供参考,不构成法律建议。



权利要求列表点击可跳转

序号 权利要求内容

1

一种增强媒体记录的方法,包括: - 访问所述媒体记录,所述媒体记录包括场景的相机记录,所述场景包括显示视觉内容的屏幕; - 分析所述相机记录以确定所述屏幕在所述相机记录中的坐标; - 访问所述视觉内容的原始版本;以及 - 在所述相机记录中并且使用所述屏幕的坐标将在所述屏幕上显示的视觉内容替换为所述视觉内容的原始版本,由此获得增强媒体记录。

2

根据权利要求1所述的方法,其中访问所述视觉内容的原始版本包括:- 标识在所述屏幕上显示的视觉内容; - 基于所显示的视觉内容已经被标识,标识包括所述视觉内容的原始版本的资源位置;以及- 从所述资源位置访问所述视觉内容的原始版本。

3

根据权利要求2所述的方法,其中标识在所述屏幕上显示的视觉内容包括:- 标识与在所述屏幕上显示的视觉内容相关联的所述相机记录的内容数据; - 将自动内容识别技术应用于所述内容数据以标识所述视觉内容。

4

根据权利要求3所述的方法,其中所述自动内容识别技术包括确定以下中的至少一个:所述内容数据的音频水印、视频水印或指纹。

5

根据权利要求2所述的方法,其中在所述屏幕上显示的视觉内容表示由媒体设备的播出,并且其中标识在所述屏幕上显示的视觉内容包括从媒体设备获得指示所述视觉内容的播出信息。

6

根据权利要求5所述的方法,其中获得所述播出信息包括:- 针对所述播出信息经由网络查询媒体设备;或者- 媒体设备经由网络发送所述播出信息。

7

根据上述权利要求中任一项所述的方法,其中在场景的相机记录中的视觉内容的替换包括调整所述视觉内容的原始版本的一个或多个视觉性质。

8

根据权利要求7所述的方法,其中所述一个或多个视觉性质包括以下中的一个或多个:对比度、亮度、白平衡、动态范围、帧速率、空间分辨率、几何形状、焦点、3D角度、3D深度。

9

根据上述权利要求1至6中任一项所述的方法,其中所述媒体记录由发送器设备获得以用于发送到接收器设备,其中在场景的相机记录中的视觉内容的替换由接收器设备执行,并且其中所述方法还包括:- 发送器设备检索所述视觉内容的原始版本并随后将所述视觉内容的原始版本发送到接收器设备;或者- 发送器设备向接收器设备发送指示所述视觉内容的原始版本可从其访问的资源位置的元数据,并且接收器设备基于所述元数据从所述资源位置检索所述视觉内容的原始版本。

10

根据权利要求9所述的方法,还包括发送器设备在所述元数据中包括所述屏幕在所述相机记录中的坐标。

11

一种具有存储于其上的指令的计算机可读介质,当所述指令被执行时使得处理器系统执行根据权利要求1至10中任一项所述的方法。

12

一种用于增强媒体记录的系统,包括:- 第一输入接口,用于访问所述媒体记录,所述媒体记录包括场景的相机记录,所述场景包括显示视觉内容的屏幕; - 分析子系统,用于分析所述相机记录以确定所述屏幕在所述相机记录中的坐标; - 第二输入接口,用于访问所述视觉内容的原始版本;以及- 替换子系统,用于在所述相机记录中并且使用所述屏幕的坐标将在所述屏幕上显示的视觉内容替换为所述视觉内容的原始版本,由此获得增强媒体记录。

13

根据权利要求12所述的系统,包括发送器设备和接收器设备,所述发送器设备包括:- 所述第一输入接口; - 所述分析子系统; 并且所述接收器设备包括: - 所述第二输入接口;以及 - 所述替换子系统。

14

根据权利要求13所述的系统,其中:- 发送器设备被配置用于检索所述视觉内容的原始版本并随后将所述视觉内容的原始版本发送到接收器设备;或者- 发送器设备被配置用于向接收器设备发送指示所述视觉内容的原始版本可从其访问的资源位置的元数据,并且接收器设备被配置用于基于所述元数据从所述资源位置检索所述原始版本。

15

根据权利要求13或14所述的发送器设备或接收器设备。


对比文件列表

编号 名称
0 2004-01-22_US2004012613A_发明申请_US20040012613A1 Video cloaking and content augmentation.docx
0 2004-06-17_US2004116183A_发明申请_US20040116183A1 Digital advertisement insertion system and method for video games.docx
0 2007-02-13_US7176957B_发明授权_US07176957B2 Local video loopback method for a multi-participant conference system using a back-channel video interface.docx
0 2008-03-27_US2008077954A_发明申请_US20080077954A1 Promotional placement in media works.docx
0 2009-08-13_US2009204639A_发明申请_US20090204639A1 SELECTIVE CONTENT REPLACEMENT FOR MEDIA PLAYERS.docx
0 2012-02-09_US2012033876A_发明申请_US20120033876A1 IDENTIFYING VISUAL MEDIA CONTENT CAPTURED BY CAMERA-ENABLED MOBILE DEVICE_+++A_B_C_E_F_G_H_I_J_T_U_V+++.docx
0 2014-05-22_US2014139609A_发明申请_US20140139609A1 METHOD AND APPARATUS FOR PROVIDING VIDEO CONFERENCING.docx
0 2014-06-26_US2014178029A_发明申请_US20140178029A1 Novel Augmented Reality Kiosks.docx

权利要求1

一种增强媒体记录的方法,包括: - 访问所述媒体记录,所述媒体记录包括场景的相机记录,所述场景包括显示视觉内容的屏幕; - 分析所述相机记录以确定所述屏幕在所述相机记录中的坐标; - 访问所述视觉内容的原始版本;以及 - 在所述相机记录中并且使用所述屏幕的坐标将在所述屏幕上显示的视觉内容替换为所述视觉内容的原始版本,由此获得增强媒体记录。


未提交复审委

无效理由:专利法第二十二条

蒋 晓勇
@jxy

作为一名经验丰富的专利代理师,我将为您对目标专利的权利要求1进行深度法律与技术层面的剖析。

在本案中,目标专利属于**图像处理与媒体增强技术领域**。我们目前掌握了一份关键的对比文件(下称 D1):**US20120033876A1**(公开日:2012-02-09)。

以下是针对权利要求1的逐项技术特征比对、最接近对比文件选择、无效请求突破口以及检索策略的完整分析汇报。

---

## 一、 技术特征比对分析

经过对对比文件 D1(US20120033876A1)说明书原文的深度梳理,现将权利要求1的技术特征与其进行毫无异议公开(完全公开)或实质公开(等同/惯用手段替换)的比对:

### 1. 技术特征 A

* **目标专利特征:** 一种增强媒体记录的方法,包括:访问所述媒体记录,所述媒体记录包括场景的相机记录,所述场景包括显示视觉内容的屏幕;

* **D1 对应原文及出处:**

* `[0010]` "An image is received from a camera of a mobile device."

* `[0032]` "...identifies visual media content 104 externally presented by a display 106 for viewing by a user 108. A camera 110 of the mobile device 102 generates a digital image 112."

* `[0034]` "...The user points a camera of his mobile phone at the TV... processing incoming frames."

* **比对结论:** **毫无异议公开。** D1 明确公开了通过移动设备的相机捕捉(即相机记录)正在播放视觉内容(如电影、电视)的外部显示器/电视(即屏幕)的图像或帧序列。

### 2. 技术特征 B

* **目标专利特征:** 分析所述相机记录以确定所述屏幕在所述相机记录中的坐标;

* **D1 对应原文及出处:**

* `[0010]` "A quadrilateral is detected contained within the image."

* `[0032]` "A computing platform 114 detects a quadrilateral 116, which corresponds to the external display 106 and is contained within the digital image 112..."

* `[0045]-[0051]` 详细描述了从图像中识别四边形(Quadrilateral candidates)的几何算法(如内角、长宽比等)。

* **比对结论:** **毫无异议公开/实质公开。** 虽然 D1 频繁使用的是“检测图像中的四边形(quadrilateral)”,但在数字图像处理中,检测出四边形的核心本质就是确定该四边形顶点在当前图像坐标系中的**像素坐标位置**。因此,特征 B 已被 D1 完全实质公开。

### 3. 技术特征 C

* **目标专利特征:** 访问所述视觉内容的原始版本;

* **D1 对应原文及出处:**

* `[0032]` "Identifying information 124 or a more complete version 126 of the visual media content 104 can then be transmitted over an air channel 128 to the mobile device..."

* `[0034]` "Once the name of the movie and timestamp are discovered, the device can connect to a proprietary service, purchase, and then download the entire movie but stream the title from the spot the user is currently viewing the film on the TV."

* **比对结论:** **毫无异议公开。** D1 明确指出,在通过服务器对捕获的内容进行指纹识别(如 SIFT 或直方图)后,会获取该视觉媒体的“更完整版本(more complete version)”或在 proprietary service 上“下载/串流整部电影”,这完全对应了目标专利所述的“访问所述视觉内容的原始版本”。

### 4. 技术特征 D

* **目标专利特征:** 在所述相机记录中并且使用所述屏幕的坐标将在所述屏幕上显示的视觉内容替换为所述视觉内容的原始版本,由此获得增强媒体记录。

* **D1 对应原文及出处:**

* `[0032]` 提及将“更完整版本126”发送至移动设备并在用户界面130上呈现(presenting on a user interface 130 to the user 108)。

* `[0034]` 提及在移动设备上从电视播放的对应时间点继续串流/播放该电影(stream the title from the spot the user is currently viewing)。

* `[0073]` 提及智能手机可以对透视畸变进行校正(optimally correct for the perspective)。

* **比对结论:** **未公开。**

* **关键技术偏差:** D1 的落脚点是“识别并接续播放”——即用户用手机拍一下电视,手机识别出是什么电影后,在手机独立的 UI 界面上**单独全屏串流**原始视频。

* 而目标专利的特征 D 是“在原相机记录中”,利用定位出的屏幕坐标,将原图里那个倾斜、反光、低清的“屏幕区域”内部的内容**原地替换**为原始高清版本,从而生成一个“混合增强的媒体记录”。D1 并没有将原始版本“塞回/替换”到原相机帧坐标范围内的技术教导。

---

## 二、 权利要求特征比对表

目标专利权利要求1的技术特征D1(US20120033876A1)对应原文及出处比对结论
技术特征A: 访问包括场景相机记录的媒体记录,场景中包含显示视觉内容的屏幕[0010], [0032], [0034]:通过手机相机接收包含外部显示器(电视)播放媒体内容的图像/帧。毫无异议公开
技术特征B: 分析相机记录以确定屏幕在其中的坐标[0010], [0032], [0045]-[0051]:检测数字图像中代表外部显示器的四边形区(其本质即确定边界坐标)。实质公开
技术特征C: 访问所述视觉内容的原始版本[0032], [0034]:识别媒体后,从服务器或专利服务下载或串流获取电影的“更完整版本(more complete version)”。毫无异议公开
技术特征D: 在相机记录中使用屏幕坐标将屏幕显示内容替换为原始版本,获得增强媒体记录✕ 未公开(D1 仅在手机屏幕/UI上独立接续播放原始视频,未做原位坐标替换增强)。未公开

---

## 三、 最接近对比文件(D1)的适配性分析

在本案的创造性分析中,**D1(US20120033876A1)非常适合作为最接近的对比文件(第一独立对比文件)**。

* **技术领域高度重合:** 两者均属于利用移动终端相机拍摄外部屏幕、并对屏幕中播放的视觉媒体进行识别与后续处理的图像处理技术。

* **整体解决的技术问题相似:** 两者都旨在解决“用户在特定场景下观看低效、受限的外部屏幕媒体时,如何利用移动设备获取并提供更高清、更完整的原始高质量媒体资源”的问题。

* **技术效果重叠度高:** 均达到了消除环境噪点、让用户体验到无失真、无反光的“原始高质量视频”的视觉效果。

* **特征覆盖率高:** 权利要求1共包含4个核心步骤特征(A、B、C、D),D1 独立且完整地公开了前3个(A、B、C),构成了最主要的控制逻辑骨架。

---

## 四、 提出无效请求最薄弱的技术特征

本案若要成功提起无效宣告请求,**最薄弱(最难被攻破、对专利权人而言最稳固)的技术特征是:技术特征D。**

即:`“在所述相机记录中并且使用所述屏幕的坐标将在所述屏幕上显示的视觉内容替换为所述视觉内容的原始版本”`。

> **薄弱原因分析(从请求人视角):**

> 现有技术(如 D1)的常规做法是“重定向播放”——识别出内容后,直接在手机上全屏播放高清源,抛弃原来的拍摄画面。

> 而本专利将其限定在“原相机记录画面内”进行“原位几何替换”(类似于一种增强现实 AR 技术的应用,保持背景不变,仅将框内的低清电视画面擦除并贴上高清原片)。这种“原位替换以增强原媒体记录”的架构在常规的视频检索重定向技术中不易被认为具有显而易见性。

---

## 五、 进一步的对比文件检索策略(针对特征D)

为了攻克上述“最薄弱特征D”,我们需要调整检索方向,不能仅仅局限于“视频识别(Video Identification)”或“视频指纹(Video Fingerprinting)”,而必须转向**视频编辑、增强现实(AR)以及版权保护/去噪**等交叉领域。

建议采取以下进阶检索策略:

### 1. 扩展关键词与分类号调整

* **核心检索逻辑:** `(相机捕捉/拍摄/录制) AND (屏幕/显示器/电视) AND (原位替换/增强现实/重叠/覆写/视频修复/去反光) AND (原始视频/高清源/参考视频)`

* **英文检索词拓展:**

* 屏幕/四边形定位:`screen detection`, `display localization`, `quadrilateral tracking`, `homography matrix`

* 替换/内容注入:`content replacement`, `video insertion`, `augmented reality`, `overlay`, `superimpose`, `texture mapping`, `video inpainting`

* 原始/参考源:`pristine video`, `original source`, `reference video`, `high-quality source`

* **IPC/CPC 分类号聚焦:**

* `G06T19/00`(修改图像数据以创造增强现实 AR)

* `G06T7/30`(图像配准/对齐)

* `G11B27/031`(电子视频编辑)

* `H04N5/272`(手段如:多源图像合成、键控背景替换)

### 2. 针对性检索场景设想(寻找 D2/D3 结合手段)

我们需要寻找以下几类技术文献作为 D2,与 D1 进行结合:

* **用户生成内容(UGC)视频增强:** 检索是否存在一种技术,当用户在电影院盗拍或在家翻拍电视并上传网络时,服务器识别出该视频,并自动利用原始高清片源“替换”掉翻拍视频里的那个屏幕区域,以提升流媒体画质或用于版权覆盖(视频指纹原位替换)。

* **AR 广告替换技术(Virtual Advertising):** 极其类似于在球赛直播中,动态识别球场周边的广告牌屏幕(即特征B),然后利用广告商提供的原始数字海报(特征C)在视频流中将广告牌原位替换掉(特征D)。这种技术在电视广播领域非常成熟(如 `H04N` 相关分类号),可作为强有力的领域转用教导。

通过 **D1(负责公开手机拍屏幕、识别并获取原片) + D2(负责公开利用配准算法将高质量原片原位贴回视频对应坐标框内)** 的结合,将能给予权利要求1致命的一击。


权利要求2

根据权利要求1所述的方法,其中访问所述视觉内容的原始版本包括:- 标识在所述屏幕上显示的视觉内容; - 基于所显示的视觉内容已经被标识,标识包括所述视觉内容的原始版本的资源位置;以及- 从所述资源位置访问所述视觉内容的原始版本。


权利要求3

根据权利要求2所述的方法,其中标识在所述屏幕上显示的视觉内容包括:- 标识与在所述屏幕上显示的视觉内容相关联的所述相机记录的内容数据; - 将自动内容识别技术应用于所述内容数据以标识所述视觉内容。


权利要求4

根据权利要求3所述的方法,其中所述自动内容识别技术包括确定以下中的至少一个:所述内容数据的音频水印、视频水印或指纹。


权利要求5

根据权利要求2所述的方法,其中在所述屏幕上显示的视觉内容表示由媒体设备的播出,并且其中标识在所述屏幕上显示的视觉内容包括从媒体设备获得指示所述视觉内容的播出信息。


权利要求6

根据权利要求5所述的方法,其中获得所述播出信息包括:- 针对所述播出信息经由网络查询媒体设备;或者- 媒体设备经由网络发送所述播出信息。


权利要求7

根据上述权利要求中任一项所述的方法,其中在场景的相机记录中的视觉内容的替换包括调整所述视觉内容的原始版本的一个或多个视觉性质。


权利要求8

根据权利要求7所述的方法,其中所述一个或多个视觉性质包括以下中的一个或多个:对比度、亮度、白平衡、动态范围、帧速率、空间分辨率、几何形状、焦点、3D角度、3D深度。


权利要求9

根据上述权利要求1至6中任一项所述的方法,其中所述媒体记录由发送器设备获得以用于发送到接收器设备,其中在场景的相机记录中的视觉内容的替换由接收器设备执行,并且其中所述方法还包括:- 发送器设备检索所述视觉内容的原始版本并随后将所述视觉内容的原始版本发送到接收器设备;或者- 发送器设备向接收器设备发送指示所述视觉内容的原始版本可从其访问的资源位置的元数据,并且接收器设备基于所述元数据从所述资源位置检索所述视觉内容的原始版本。


权利要求10

根据权利要求9所述的方法,还包括发送器设备在所述元数据中包括所述屏幕在所述相机记录中的坐标。


权利要求11

一种具有存储于其上的指令的计算机可读介质,当所述指令被执行时使得处理器系统执行根据权利要求1至10中任一项所述的方法。


权利要求12

一种用于增强媒体记录的系统,包括:- 第一输入接口,用于访问所述媒体记录,所述媒体记录包括场景的相机记录,所述场景包括显示视觉内容的屏幕; - 分析子系统,用于分析所述相机记录以确定所述屏幕在所述相机记录中的坐标; - 第二输入接口,用于访问所述视觉内容的原始版本;以及- 替换子系统,用于在所述相机记录中并且使用所述屏幕的坐标将在所述屏幕上显示的视觉内容替换为所述视觉内容的原始版本,由此获得增强媒体记录。


权利要求13

根据权利要求12所述的系统,包括发送器设备和接收器设备,所述发送器设备包括:- 所述第一输入接口; - 所述分析子系统; 并且所述接收器设备包括: - 所述第二输入接口;以及 - 所述替换子系统。


权利要求14

根据权利要求13所述的系统,其中:- 发送器设备被配置用于检索所述视觉内容的原始版本并随后将所述视觉内容的原始版本发送到接收器设备;或者- 发送器设备被配置用于向接收器设备发送指示所述视觉内容的原始版本可从其访问的资源位置的元数据,并且接收器设备被配置用于基于所述元数据从所述资源位置检索所述原始版本。


权利要求15

根据权利要求13或14所述的发送器设备或接收器设备。


Powered by Django

网站备案号:渝ICP备2023012882号


重庆市非显而易见网络科技有限责任公司 A Anti NPE NPE