JP2017204280A - ビデオフレームを選択する方法、システム及び装置 - Google Patents
ビデオフレームを選択する方法、システム及び装置 Download PDFInfo
- Publication number
- JP2017204280A JP2017204280A JP2017094882A JP2017094882A JP2017204280A JP 2017204280 A JP2017204280 A JP 2017204280A JP 2017094882 A JP2017094882 A JP 2017094882A JP 2017094882 A JP2017094882 A JP 2017094882A JP 2017204280 A JP2017204280 A JP 2017204280A
- Authority
- JP
- Japan
- Prior art keywords
- detected
- face
- faces
- video
- frame
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Granted
Links
Classifications
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06V—IMAGE OR VIDEO RECOGNITION OR UNDERSTANDING
- G06V20/00—Scenes; Scene-specific elements
- G06V20/40—Scenes; Scene-specific elements in video content
- G06V20/46—Extracting features or characteristics from the video content, e.g. video fingerprints, representative shots or key frames
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06V—IMAGE OR VIDEO RECOGNITION OR UNDERSTANDING
- G06V40/00—Recognition of biometric, human-related or animal-related patterns in image or video data
- G06V40/10—Human or animal bodies, e.g. vehicle occupants or pedestrians; Body parts, e.g. hands
- G06V40/16—Human faces, e.g. facial parts, sketches or expressions
- G06V40/168—Feature extraction; Face representation
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06V—IMAGE OR VIDEO RECOGNITION OR UNDERSTANDING
- G06V20/00—Scenes; Scene-specific elements
- G06V20/40—Scenes; Scene-specific elements in video content
- G06V20/46—Extracting features or characteristics from the video content, e.g. video fingerprints, representative shots or key frames
- G06V20/47—Detecting features for summarising video content
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06V—IMAGE OR VIDEO RECOGNITION OR UNDERSTANDING
- G06V40/00—Recognition of biometric, human-related or animal-related patterns in image or video data
- G06V40/10—Human or animal bodies, e.g. vehicle occupants or pedestrians; Body parts, e.g. hands
- G06V40/18—Eye characteristics, e.g. of the iris
Landscapes
- Engineering & Computer Science (AREA)
- Physics & Mathematics (AREA)
- General Physics & Mathematics (AREA)
- Multimedia (AREA)
- Theoretical Computer Science (AREA)
- Health & Medical Sciences (AREA)
- Oral & Maxillofacial Surgery (AREA)
- General Health & Medical Sciences (AREA)
- Human Computer Interaction (AREA)
- Computer Vision & Pattern Recognition (AREA)
- Ophthalmology & Optometry (AREA)
- Image Analysis (AREA)
Abstract
【解決手段】複数の顔がビデオシーケンスの少なくとも1つのビデオフレームにおいて検出される。検出された顔の向きは、第1の検出された顔が第2の検出された顔の方を向いていくかを判定するために、一連の後続するビデオフレーム上で追跡される。方法は、その後、検出された顔の追跡された向きを用いて、検出された顔の凝視固定を特定する少なくとも所定数のフレームについて、第1及び第2の検出された顔が互いの方を向いているビデオシーケンスの一部を判定する。ビデオシーケンスの判定された一部から少なくとも1つのビデオフレームを選択する。
【選択図】図4
Description
前記ビデオシーケンスの少なくとも1つのビデオフレームにおいて複数の顔を検出し、
第1の検出された顔が第2の検出された顔の方を向いていくかを判定するために、一連の後続するビデオフレーム上で前記検出された複数の顔の向きを追跡し、
前記検出された複数の顔の前記追跡された向きを用いて、前記検出された複数の顔の凝視固定を特定する少なくとも所定数のフレームである、前記第1及び第2の検出された顔が互いの方を向いている前記ビデオシーケンスの一部を判定し、
前記ビデオシーケンスの前記判定された一部から少なくとも1つのビデオフレームを選択することを有し、前記選択されたビデオフレームは、前記検出された顔の前記凝視固定をキャプチャするものであることを特徴とする。
データ及びコンピュータプログラムを記憶するメモリと、
前記コンピュータプログラムを実行する前記メモリと結合したプロセッサとを有し、前記コンピュータプログラムは、
前記ビデオシーケンスの少なくとも1つのビデオフレームにおいて複数の顔を検出し、
第1の検出された顔が第2の検出された顔の方を向いていくかを判定するために、一連の後続するビデオフレーム上で前記検出された複数の顔の向きを追跡し、
前記検出された複数の顔の前記追跡された向きを用いて、前記検出された複数の顔の凝視固定を特定する少なくとも所定数のフレームである、前記第1及び第2の検出された顔が互いの方を向いている前記ビデオシーケンスの一部を判定し、
前記ビデオシーケンスの前記判定された一部から少なくとも1つのビデオフレームを選択するインストラクションを有し、前記選択されたビデオフレームは、前記検出された顔の凝視固定をキャプチャするものであることを特徴とする。
前記ビデオシーケンスの少なくとも1つのビデオフレームにおいて複数の顔を検出する手段と、
第1の検出された顔が第2の検出された顔の方を向いていくかを判定するために、一連の後続するビデオフレーム上で前記検出された複数の顔の向きを追跡する手段と、
前記検出された複数の顔の前記追跡された向きを用いて、前記検出された複数の顔の凝視固定を特定する少なくとも所定数のフレームである、前記第1及び第2の検出された顔が互いの方を向いている前記ビデオシーケンスの一部を判定する手段と、
前記ビデオシーケンスの前記判定された一部から少なくとも1つのビデオフレームを選択する手段と、を有し、前記選択されたビデオフレームは、前記検出された顔の凝視固定をキャプチャするものであることを特徴とする。
前記ビデオシーケンスの少なくとも1つのビデオフレームにおいて複数の顔を検出するコードと、
第1の検出された顔が第2の検出された顔の方を向いていくかを判定するために、一連の後続するビデオフレーム上で前記検出された複数の顔の向きを追跡するコードと、
前記検出された複数の顔の前記追跡された向きを用いて、前記検出された複数の顔の凝視固定を特定する少なくとも所定数のフレームである、前記第1及び第2の検出された顔が互いの方を向いている前記ビデオシーケンスの一部を判定するコードと、
前記ビデオシーケンスの前記判定された一部から少なくとも1つのビデオフレームを選択するコードと、を有し、前記選択されたビデオフレームは、前記検出された顔の凝視固定をキャプチャするものであることを特徴とする。
記憶位置128、129、130からインストラクション131をフェッチ若しくは読み出すフェッチオペレーションと、
コントロールユニット139がどのインストラクションがフェッチされたかを判定するデコードオペレーションと、
コントロールユニット139及び/又はALU140がインストラクションを実行する実行オペレーションと、を含む。
述べた構成は、コンピュータ及びデータ処理産業、とりわけ、画像処理について適用される。
Claims (11)
- ビデオシーケンスの少なくとも1つのビデオフレームを選択する方法であって、
前記ビデオシーケンスの少なくとも1つのビデオフレームにおいて複数の顔を検出し、
第1の検出された顔が第2の検出された顔の方を向いていくかを判定するために、一連の後続するビデオフレーム上で前記検出された複数の顔の向きを追跡し、
前記検出された複数の顔の前記追跡された向きを用いて、前記検出された複数の顔の凝視固定を特定する少なくとも所定数のフレームである、前記第1及び第2の検出された顔が互いの方を向いている前記ビデオシーケンスの一部を判定し、
前記ビデオシーケンスの前記判定された一部から少なくとも1つのビデオフレームを選択することを有し、
前記選択されたビデオフレームは、前記検出された顔の凝視固定をキャプチャするものであることを特徴とする方法。 - 前記第1の検出された顔は、前記第2の検出された顔が静止している間に、前記第2の検出された顔の方を向いていく顔であることを特徴とする請求項1に記載の方法。
- 前記凝視固定は閾値期間に依存することを特徴とする請求項1に記載の方法。
- 前記凝視固定は最小のターニング時間に依存することを特徴とする請求項1に記載の方法。
- 前記選択されたフレームの中央の領域の外側の顔は無視されることを特徴とする請求項1に記載の方法。
- フォトブックにおいて前記選択されたフレームを印刷することをさらに有することを特徴とする請求項1に記載の方法。
- 前記ビデオシーケンスの概略説明において前記選択されたフレームを表示することを有することを特徴とする請求項1に記載の方法。
- 前記ビデオシーケンスの前記一部の前記フレームにおいて、前記第1の検出された顔は、前記第2の顔と相対的に前方を向いており、前記第2の顔は、前記第1の顔と相対的に後方を向いていることを特徴とする請求項1に記載の方法。
- ビデオシーケンスの少なくとも1つのビデオフレームを選択するシステムであって、
データ及びコンピュータプログラムを記憶するメモリと、
前記コンピュータプログラムを実行するためのメモリと結合されたプロセッサと、を有し、前記コンピュータプログラムは、
前記ビデオシーケンスの少なくとも1つのビデオフレームにおいて複数の顔を検出し、
第1の検出された顔が第2の検出された顔の方を向いていくかを判定するために、一連の後続するビデオフレーム上で前記検出された複数の顔の向きを追跡し、
前記検出された複数の顔の前記追跡された向きを用いて、前記検出された複数の顔の凝視固定を特定する少なくとも所定数のフレームである、前記第1及び第2の検出された顔が互いの方を向いている前記ビデオシーケンスの一部を判定し、
前記ビデオシーケンスの前記判定された一部から少なくとも1つのビデオフレームを選択するインストラクションを有し、
前記選択されたビデオフレームは、前記検出された顔の凝視固定をキャプチャするものであることを特徴とするシステム。 - ビデオシーケンスの少なくとも1つのビデオフレームを選択する装置であって、
前記ビデオシーケンスの少なくとも1つのビデオフレームにおいて複数の顔を検出する手段と、
第1の検出された顔が第2の検出された顔の方を向いていくかを判定するために、一連の後続するビデオフレーム上で前記検出された複数の顔の向きを追跡する手段と、
前記検出された複数の顔の前記追跡された向きを用いて、前記検出された複数の顔の凝視固定を特定する少なくとも所定数のフレームである、前記第1及び第2の検出された顔が互いの方を向いている前記ビデオシーケンスの一部を判定する手段と、
前記ビデオシーケンスの前記判定された一部から少なくとも1つのビデオフレームを選択する手段と、を有し、
前記選択されたビデオフレームは、前記検出された顔の凝視固定をキャプチャするものであることを特徴とする装置。 - ビデオシーケンスの少なくとも1つのビデオフレームを選択するための、媒体上に記憶されたコンピュータプログラムを有するコンピュータ読取可能な媒体であって、前記プログラムは、
前記ビデオシーケンスの少なくとも1つのビデオフレームにおいて複数の顔を検出するコードと、
第1の検出された顔が第2の検出された顔の方を向いていくかを判定するために、一連の後続するビデオフレーム上で前記検出された複数の顔の向きを追跡するコードと、
前記検出された複数の顔の前記追跡された向きを用いて、前記検出された複数の顔の凝視固定を特定する少なくとも所定数のフレームである、前記第1及び第2の検出された顔が互いの方を向いている前記ビデオシーケンスの一部を判定するコードと、
前記ビデオシーケンスの前記判定された一部から少なくとも1つのビデオフレームを選択するコードと、を有し、
前記選択されたビデオフレームは、前記検出された顔の凝視固定をキャプチャするものであることを特徴とするコンピュータ読取可能な媒体。
Applications Claiming Priority (2)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| AU2016203135A AU2016203135A1 (en) | 2016-05-13 | 2016-05-13 | Method, system and apparatus for selecting a video frame |
| AU2016203135 | 2016-05-13 |
Publications (2)
| Publication Number | Publication Date |
|---|---|
| JP2017204280A true JP2017204280A (ja) | 2017-11-16 |
| JP6373446B2 JP6373446B2 (ja) | 2018-08-15 |
Family
ID=60294826
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| JP2017094882A Active JP6373446B2 (ja) | 2016-05-13 | 2017-05-11 | ビデオフレームを選択するプログラム、システム、装置、及び方法 |
Country Status (3)
| Country | Link |
|---|---|
| US (1) | US10372994B2 (ja) |
| JP (1) | JP6373446B2 (ja) |
| AU (1) | AU2016203135A1 (ja) |
Families Citing this family (5)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| US10460196B2 (en) * | 2016-08-09 | 2019-10-29 | Adobe Inc. | Salient video frame establishment |
| AU2017245322A1 (en) * | 2017-10-10 | 2019-05-02 | Canon Kabushiki Kaisha | Method, system and apparatus for selecting frames of a video sequence |
| WO2019089591A1 (en) * | 2017-10-30 | 2019-05-09 | Mobileye Vision Technologies Ltd. | Vehicle navigation based on human activity |
| US12008812B2 (en) * | 2020-09-30 | 2024-06-11 | Alarm.Com Incorporated | Simultaneous playback of continuous video recordings from multiple recording devices |
| CN112911385B (zh) * | 2021-01-12 | 2021-12-07 | 平安科技(深圳)有限公司 | 待识别图片的提取方法、装置、设备以及存储介质 |
Citations (3)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JP2010258487A (ja) * | 2009-04-21 | 2010-11-11 | Nippon Telegr & Teleph Corp <Ntt> | ビデオ画像プリント装置およびビデオ画像プリントプログラム |
| JP2011082915A (ja) * | 2009-10-09 | 2011-04-21 | Sony Corp | 情報処理装置、画像抽出方法及び画像抽出プログラム |
| JP2013038662A (ja) * | 2011-08-09 | 2013-02-21 | Canon Inc | 画像処理装置、方法及びプログラム |
Family Cites Families (14)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| US6393136B1 (en) | 1999-01-04 | 2002-05-21 | International Business Machines Corporation | Method and apparatus for determining eye contact |
| SG91841A1 (en) | 1999-11-03 | 2002-10-15 | Kent Ridge Digital Labs | Face direction estimation using a single gray-level image |
| JP2005124160A (ja) | 2003-09-25 | 2005-05-12 | Fuji Photo Film Co Ltd | 会議支援システム、情報表示装置、プログラム、及び制御方法 |
| US7634108B2 (en) * | 2006-02-14 | 2009-12-15 | Microsoft Corp. | Automated face enhancement |
| US8379154B2 (en) | 2006-05-12 | 2013-02-19 | Tong Zhang | Key-frame extraction from video |
| US7916894B1 (en) | 2007-01-29 | 2011-03-29 | Adobe Systems Incorporated | Summary of a video using faces |
| US20090019472A1 (en) * | 2007-07-09 | 2009-01-15 | Cleland Todd A | Systems and methods for pricing advertising |
| US8401248B1 (en) * | 2008-12-30 | 2013-03-19 | Videomining Corporation | Method and system for measuring emotional and attentional response to dynamic digital media content |
| US8817126B2 (en) | 2009-06-24 | 2014-08-26 | Hewlett-Packard Development Company, L.P. | Compilation of images |
| JP2012038106A (ja) | 2010-08-06 | 2012-02-23 | Canon Inc | 情報処理装置、情報処理方法、およびプログラム |
| US8520052B2 (en) | 2011-02-02 | 2013-08-27 | Microsoft Corporation | Functionality for indicating direction of attention |
| US8854282B1 (en) | 2011-09-06 | 2014-10-07 | Google Inc. | Measurement method |
| US9329682B2 (en) | 2013-06-18 | 2016-05-03 | Microsoft Technology Licensing, Llc | Multi-step virtual object selection |
| GB2528330B (en) * | 2014-07-18 | 2021-08-04 | Unifai Holdings Ltd | A method of video analysis |
-
2016
- 2016-05-13 AU AU2016203135A patent/AU2016203135A1/en not_active Abandoned
-
2017
- 2017-05-02 US US15/585,020 patent/US10372994B2/en active Active
- 2017-05-11 JP JP2017094882A patent/JP6373446B2/ja active Active
Patent Citations (3)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JP2010258487A (ja) * | 2009-04-21 | 2010-11-11 | Nippon Telegr & Teleph Corp <Ntt> | ビデオ画像プリント装置およびビデオ画像プリントプログラム |
| JP2011082915A (ja) * | 2009-10-09 | 2011-04-21 | Sony Corp | 情報処理装置、画像抽出方法及び画像抽出プログラム |
| JP2013038662A (ja) * | 2011-08-09 | 2013-02-21 | Canon Inc | 画像処理装置、方法及びプログラム |
Also Published As
| Publication number | Publication date |
|---|---|
| US20170330038A1 (en) | 2017-11-16 |
| AU2016203135A1 (en) | 2017-11-30 |
| JP6373446B2 (ja) | 2018-08-15 |
| US10372994B2 (en) | 2019-08-06 |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| US10706892B2 (en) | Method and apparatus for finding and using video portions that are relevant to adjacent still images | |
| CN108197586B (zh) | 脸部识别方法和装置 | |
| JP6373446B2 (ja) | ビデオフレームを選択するプログラム、システム、装置、及び方法 | |
| EP3614304B1 (en) | Avatar video apparatus and method | |
| US11042725B2 (en) | Method for selecting frames used in face processing | |
| US20130021490A1 (en) | Facial Image Processing in an Image Capture Device | |
| EP2998960B1 (en) | Method and device for video browsing | |
| CN105190685B (zh) | 用于提供用于计算机视觉应用程序的自适应数据路径的方法和设备 | |
| CN113302907B (zh) | 拍摄方法、装置、设备及计算机可读存储介质 | |
| US9838616B2 (en) | Image processing method and electronic apparatus | |
| WO2017177768A1 (zh) | 一种信息处理方法及终端、计算机存储介质 | |
| JP2016149063A (ja) | 感情推定装置及び感情推定方法 | |
| CN110807368B (zh) | 一种注入攻击的识别方法、装置及设备 | |
| JP6157165B2 (ja) | 視線検出装置及び撮像装置 | |
| CN105827928A (zh) | 一种选择对焦区域的方法及装置 | |
| WO2014074959A1 (en) | Real-time face detection using pixel pairs | |
| CN118355405A (zh) | 利用单目深度估计的分割 | |
| CN115239551A (zh) | 视频增强方法和装置 | |
| US8184869B2 (en) | Digital image enhancement | |
| CN107705279B (zh) | 实现双重曝光的图像数据实时处理方法及装置、计算设备 | |
| CN105229700B (zh) | 用于从多个连续拍摄图像提取峰图像的设备和方法 | |
| CN111259757A (zh) | 一种基于图像的活体识别方法、装置及设备 | |
| KR101835531B1 (ko) | 얼굴 인식 기반의 증강현실 영상을 제공하는 디스플레이 장치 및 이의 제어 방법 | |
| EP3471017A1 (en) | Method, system and apparatus for selecting frames of a video sequence | |
| CN110121030B (zh) | 一种保存拍摄图像的方法以及电子设备 |
Legal Events
| Date | Code | Title | Description |
|---|---|---|---|
| A131 | Notification of reasons for refusal |
Free format text: JAPANESE INTERMEDIATE CODE: A131 Effective date: 20180319 |
|
| A521 | Request for written amendment filed |
Free format text: JAPANESE INTERMEDIATE CODE: A523 Effective date: 20180517 |
|
| TRDD | Decision of grant or rejection written | ||
| A01 | Written decision to grant a patent or to grant a registration (utility model) |
Free format text: JAPANESE INTERMEDIATE CODE: A01 Effective date: 20180619 |
|
| A61 | First payment of annual fees (during grant procedure) |
Free format text: JAPANESE INTERMEDIATE CODE: A61 Effective date: 20180717 |
|
| R151 | Written notification of patent or utility model registration |
Ref document number: 6373446 Country of ref document: JP Free format text: JAPANESE INTERMEDIATE CODE: R151 |