突破3D數據的瓶頸,推動3D產業發展
2018-08-06 08:39:20
【突破3D數據的瓶頸,推動3D產業發展】蘋果發布iPhoneX,并基于3D結構光技術推出了名為“FaceID”的新功能用于日常解鎖和ApplePay。但彼時推出的一眾量產全面屏安卓手機僅僅只是在外貌上模仿了蘋果的劉海設計,iPhoneX“劉海屏”背后真正的大殺器是3D結構光深感攝像模組。
今年5月,OPPO曾向大眾演示了全球首個基于3D結構光技術的5G視頻通話,并宣布OPPO的3D結構光技術已經具備量產條件。而后,OPPOFindX的全面問世不僅兌現了OPPO承諾,更徹底打破了安卓陣營結構光技術短板的局面,這項技術自此再也不是iPhoneX的專屬功能了。
vivo在2018MWC上海震撼發布了TOF3D超感應技術。在現場,用戶只需要站上vivo的體驗機,搖臂上搭載了TOF3D超感應技術的原型機就會對用戶的頭部進行環形掃描,錄入之后很快就會形成一個高精度的3D人臉模型,輪廓和細節的把控都十分出色,用戶還可以拖動模型查看任一角度的自己。

很多人不禁要問,這是一種什么樣的黑科技?
TOF3D超感應技術所采用的是發射光脈沖的形式,通過脈沖發射器連續發射脈沖,然后脈沖波遇到物體反射,反射的脈沖被接收器接受,CPU再將這一系列數據進行分析和建模,最后得出三維模型,從而實現高精度的立體信息采集和輸入。
安卓陣營突破3D結構光技術瓶頸
人類是通過兩只眼睛觀察立體世界的,為了讓手機像人一樣獲得三維立體的圖像信息,手機廠商們接連推出了雙攝方案,雖然雙目攝像頭能夠依據視差原理形成三維圖像,但是受制于光線和紋理等拍攝環境因素,雙攝產生的三維圖像差強人意,更無法滿足3D驗真環節的應用要求,所以采用主動投射編碼光獲取3D信息的結構光技術成為智能手機革新的關鍵一環。
曠視科技是全球領先的計算機視覺技術企業,致力于通過“AI+IoT”技術賦能不同的垂直領域,為各行業提供完整的智能解決方案,其中以智能手機為代表的移動終端是曠視用AI實現賦能的典型場景。
“世界上60%的攝像頭是用在手機上面的。”曠視科技云事業部高級副總裁吳文昊表示,“短期來看,曠視的首要任務就是賦能全球十億攝像頭,所以手機市場一定是主戰場。”2017年中,曠視科技開始布局手機市場,隨后基于核心的深度學習和計算機視覺技術一舉推出人臉支付、人臉識別解鎖、人像光效、人像背景虛化、視頻美化、3DAnimoji等一系列移動端AI產品,以滿足不同手機廠商在人臉解鎖、圖像增強、相機增強、智能圖像和視頻處理上的需求。
在最新推出的應用中,3D結構光的整個系統包含結構光投影設備、攝像機、圖像采集和處理系統。通過投影設備的發射光線到被測物體上,攝像機拍攝在被測物體上形成的三維光圖形,拍攝圖像經采集處理系統處理后便能夠獲得被測物體表面數據形成三維的圖像信息。
簡單來講3D結構光的實現原理類似于海底探測的聲吶系統是通過反射信息來確定深度的,只不過3D結構光在手機人臉識別上的應用,是通過人臉表現反射光線來確定深度信息的。相比雙目來說,其效果在同樣的場景下能夠得到更完整、更細膩的深度圖。
3D時代來臨移動支付更安全
相比傳統人臉識別,3D結構光技術可應用于安全支付、三維重建、AR、游戲等眾多場景,其中最重要的應用是便是安全支付,這便要求3D結構光人臉識別算法具備極高的技術水準,并做到極致的質量控制。
3D安全支付相當于曠視Face++聯合vivo基于TOF技術和人臉識別算法打造了一款安卓版的FaceID。在3D支付產品的開發中,vivo手機在曠視三個核心算法模型結構加持下,可實現0.1s內極速識別,0.03s重建和達百萬分之一的支付精度,包括多尺度多特征的注意力檢測模型,可自適應網絡、多模型融合的識別方案,以及基于業界開創性的移動卷積神經網絡ShuffleNet定制開發的活體檢測模型。有了這項技術,vivo用戶將可以用人臉替代指紋、密碼或PIN碼作為移動支付的主要驗證方式。
AI+3D創造無限想象空間
在曠視科技Face++和vivo聯合發布的一系列TOF3D超感應技術應用之前,由于科技發展的局限性,在我們手機攝像頭的眼里,世界是“平”的——攝像機給我們的反饋永遠都只是一張二維的圖像。但顯然二維已經不能滿足人們對于安全級別和影像處理的極致追求。
相比二維的人像數據,立體的三維數據具有更豐富的細節信息和商用價值。vivo在發布會中表示,將有望將3D技術應用于更廣泛的各個場景中,如用戶可以在在線購物平臺中創造真人3D形象進行試妝、試戴、試衣,或在AR/VR/MR手游中將掃描好的3D頭像植入到3D游戲中,創造逼真的同人角色。在發布會中,vivo還宣布將開啟“3D視覺開發者計劃”,邀請行業開發者、服務供應商以及用戶一起探索并不斷提升3D視覺的性能表現及體驗。
當然,從技術上講,不止是人臉,我們可以通過3D實現對實體萬物的動態實時建模。很快,面向手勢、人體、行為、商品、物體、城市甚至人與物體、人與場景的全面3D感知方案會陸續在終端實現,而那時我們的感觀生活或許完全不同。
作為行業領先的移動AI解決方案提供商,曠視科技希望通過AI賦能與3D深度信息的結合創造出實用的算法和產品,進而提升智能移動終端用戶的解鎖,影像和交互體驗。在手機領域,AI和3D深度視覺的結合已經給我們帶來了無限想象空間,而隨著對場景的深入探索和3D數據的開發,曠視希望與更多行業伙伴和開發者一同推動3D產業的發展。相信在未來1-2年內,3D技術將會出現在我們生活的每一個角落,為我們帶來更多便利。







