API / SDK / developer guide
Face Detector
| 目標讀者 TA | 人臉區域介面工程師 |
|---|---|
| 官方文件能力 | 定位人臉與臉部關鍵點。 |
| 輸入 → 輸出 | 影像/影格 → 人臉框與關鍵點。 |
| 執行環境 | 選定 Tasks SDK、相容模型與支援平台 |
| 本站選型評估 | 偵測不等於身分識別。 |
| 本站建議驗證 | 對照授權標註影格驗證框選。 |
電腦視覺 · SDK
把封裝好的感知任務整合到裝置應用。
GOOGLE MEDIAPIPE / DEVELOPER FIELD GUIDE
公司/專案背景、十個技術入口,以及每份引用的實作分析。
2026-10-08 · 串接尚未實測
依官方公司或專案自述撰寫的原創概要;完整原文請見來源。
| 專案 | MediaPipe 是 Google AI Edge 體系的開源專案。 |
|---|---|
| 用途 | 提供應用開發者可重用的機器學習解決方案。 |
| 組成 | Tasks API 與相容模型提供推論;Model Maker 支援部分客製化,Studio 支援評估。 |
| 平台與生命週期 | 任務與平台可用性不同。應使用現行 Solutions 指南;舊方案支援狀態不同。 |
| 適用角色 | 進行 AI 供應商初選的採購、合作夥伴與產品負責人。 |
|---|---|
| 本站評估 | 用定位與公司背景判斷初步適配度;另行取得專案部署、支援與商務條件。 |
已核對官方專案與開發來源;沒有呼叫供應商 API。下方預期輸出是本站示意契約,不是實測結果。
依任務選出的十個有文件技術入口;不是十套獨立 SDK 或官方排名。
| 接口 | 用途與 TA |
|---|---|
| 01 · Face DetectorAPI / SDK / developer guide | 定位人臉與臉部關鍵點。人臉區域介面工程師 |
| 02 · Face LandmarkerAPI / SDK / developer guide | 估計臉部特徵點及支援的臉部輸出。AR 與動畫工程師 |
| 03 · Gesture RecognizerAPI / SDK / developer guide | 辨識支援的手勢。非接觸介面工程師 |
| 04 · Hand LandmarkerAPI / SDK / developer guide | 估計手部特徵點與左右手。手部互動工程師 |
| 05 · Holistic LandmarkerAPI / SDK / developer guide | 整合臉部、姿態與手部特徵点估計。全身互動團隊 |
| 06 · Image ClassifierAPI / SDK / developer guide | 利用相容分類模型指派類別。影像分流工程師 |
| 07 · Image EmbedderAPI / SDK / developer guide | 將影像表示成數值嵌入。視覺檢索工程師 |
| 08 · Image SegmenterAPI / SDK / developer guide | 以相容分割模型區分影像區域。像素層級介面工程師 |
| 09 · Object DetectorAPI / SDK / developer guide | 定位與分類模型支援的物件。物件應用團隊 |
| 10 · Pose LandmarkerAPI / SDK / developer guide | 估計身體姿態特徵點。動作視覺化團隊 |
能力摘要依據官方文件;限制與建議測試為本站工程評估。
API / SDK / developer guide
| 目標讀者 TA | 人臉區域介面工程師 |
|---|---|
| 官方文件能力 | 定位人臉與臉部關鍵點。 |
| 輸入 → 輸出 | 影像/影格 → 人臉框與關鍵點。 |
| 執行環境 | 選定 Tasks SDK、相容模型與支援平台 |
| 本站選型評估 | 偵測不等於身分識別。 |
| 本站建議驗證 | 對照授權標註影格驗證框選。 |
API / SDK / developer guide
| 目標讀者 TA | AR 與動畫工程師 |
|---|---|
| 官方文件能力 | 估計臉部特徵點及支援的臉部輸出。 |
| 輸入 → 輸出 | 影像/影格 → 臉部幾何;選用輸出依設定。 |
| 執行環境 | 選定 Tasks SDK、相容模型與支援平台 |
| 本站選型評估 | 幾何不構成人物情緒或意圖證據。 |
| 本站建議驗證 | 在目標裝置測試遮擋與座標映射。 |
API / SDK / developer guide
| 目標讀者 TA | 非接觸介面工程師 |
|---|---|
| 官方文件能力 | 辨識支援的手勢。 |
| 輸入 → 輸出 | 影像/影格 → 手勢類別與手部特徵點。 |
| 執行環境 | 選定 Tasks SDK、相容模型與支援平台 |
| 本站選型評估 | 僅設定內的手勢詞彙具有指定意義。 |
| 本站建議驗證 | 未知手勢不得誤觸命令。 |
API / SDK / developer guide
| 目標讀者 TA | 手部互動工程師 |
|---|---|
| 官方文件能力 | 估計手部特徵點與左右手。 |
| 輸入 → 輸出 | 影像/影格 → 正規化與世界座標特徵點、左右手。 |
| 執行環境 | 選定 Tasks SDK、相容模型與支援平台 |
| 本站選型評估 | 鏡像與座標系統須明確。 |
| 本站建議驗證 | 刻意比較鏡像與原始輸入。 |
API / SDK / developer guide
| 目標讀者 TA | 全身互動團隊 |
|---|---|
| 官方文件能力 | 整合臉部、姿態與手部特徵点估計。 |
| 輸入 → 輸出 | 影像/影格 → 身體、臉部與手部特徵點群組。 |
| 執行環境 | 選定 Tasks SDK、相容模型與支援平台 |
| 本站選型評估 | 遺失群組應保留遺失狀態,不能補零成為虛假人物。 |
| 本站建議驗證 | 驗證局部可見與群組對應。 |
API / SDK / developer guide
| 目標讀者 TA | 影像分流工程師 |
|---|---|
| 官方文件能力 | 利用相容分類模型指派類別。 |
| 輸入 → 輸出 | 影像 → 排序類別與分數。 |
| 執行環境 | 選定 Tasks SDK、相容模型與支援平台 |
| 本站選型評估 | 類別詞彙由選定模型決定。 |
| 本站建議驗證 | 包含領域外影像並檢討門檻。 |
API / SDK / developer guide
| 目標讀者 TA | 視覺檢索工程師 |
|---|---|
| 官方文件能力 | 將影像表示成數值嵌入。 |
| 輸入 → 輸出 | 影像 → 特徵向量。 |
| 執行環境 | 選定 Tasks SDK、相容模型與支援平台 |
| 本站選型評估 | 向量不是語意標籤;須比較相容嵌入。 |
| 本站建議驗證 | 評估相關與不相關影像配對。 |
API / SDK / developer guide
| 目標讀者 TA | 像素層級介面工程師 |
|---|---|
| 官方文件能力 | 以相容分割模型區分影像區域。 |
| 輸入 → 輸出 | 影像 → 依設定輸出類別或信心遮罩。 |
| 執行環境 | 選定 Tasks SDK、相容模型與支援平台 |
| 本站選型評估 | 縮放後遮罩必須對齊才能疊圖。 |
| 本站建議驗證 | 核對像素對齊與已知區域重疊。 |
API / SDK / developer guide
| 目標讀者 TA | 物件應用團隊 |
|---|---|
| 官方文件能力 | 定位與分類模型支援的物件。 |
| 輸入 → 輸出 | 影像/影格 → 框、類別與分數。 |
| 執行環境 | 選定 Tasks SDK、相容模型與支援平台 |
| 本站選型評估 | 預訓練類別不會自動包含工廠缺陷。 |
| 本站建議驗證 | 用領域標註量測漏偵物件。 |
API / SDK / developer guide
| 目標讀者 TA | 動作視覺化團隊 |
|---|---|
| 官方文件能力 | 估計身體姿態特徵點。 |
| 輸入 → 輸出 | 影像/影格 → 正規化與世界座標姿態特徵點。 |
| 執行環境 | 選定 Tasks SDK、相容模型與支援平台 |
| 本站選型評估 | 僅姿態不能判定醫療狀態或操作安全。 |
| 本站建議驗證 | 檢查遮擋關節與連續影格穩定性。 |
| TA | 選擇支援技術路徑的工程師與產品負責人。 |
|---|---|
| 本站驗證建議 | 安排實作前先選定操作、支援版本與執行環境。 |
04 / INPUT · EXPECTED OUTPUT · ACCEPTANCE
選定 Tasks 模型的物件偵測示意契約;其他任務會回傳不同結構。未啟用攝影機或執行模型。
示意契約 · 未呼叫 API 或執行模型 · 不是供應商實測輸出
| 輸入 | 授權影像與相容物件模型。 |
|---|---|
| 預期結果 | ok;標籤、分數與明示座標系統的框。 |
| 驗收條件 | 模型標籤對應介面且縮放後框仍對齊。 |
| 輸入 | 有效影像,沒有物件超過設定門檻。 |
|---|---|
| 預期結果 | ok;detections: [];不可沿用前一影格的框。 |
| 驗收條件 | 顯示空狀態而非錯誤提示。 |
| 輸入 | 缺漏或不相容的任務模型。 |
|---|---|
| 預期結果 | error;模型初始化失敗;data 為 null。 |
| 驗收條件 | 不得捏造預測;提供可處理的設定訊息。 |
| 輸入 | 選定影片/即時模式中帶時間戳的影格。 |
|---|---|
| 預期結果 | 結果對應各自輸入影格的時間戳。 |
| 驗收條件 | 拒絕或處理無效順序;不保證每個即時影格皆有結果。 |
先審閱下方情境,再將實際 SDK 回應對應至此內部契約。此處不含憑證、API 呼叫或真實輸出,示意資料須在自行串接測試後替換。
{
"schema_version": "1.0.0",
"example": true,
"provider": "Google MediaPipe",
"status": "ok",
"input_id": "sample-001",
"data": {
"task": "object_detector",
"coordinate_system": "pixels-original-image",
"detections": [
{
"label": "sample-object",
"score": 0.82,
"box_xywh": [
12,
18,
80,
60
]
}
],
"model_asset": "record-at-integration"
},
"error": null,
"verification": "illustrative-only;not-provider-response"
}| 結果狀態 | ok 表示所選操作回傳有效結構;有效空結果與 error 不同。未完成工作保持 pending 直到終態。API 成功不代表現實判斷必然正確。 |
|---|---|
| 可重現性 | 記錄輸入識別、函式庫/模型版本、設定、執行環境及座標/分數慣例。範例數值為示意。 |
| 建議驗收 | 使用授權代表樣本,加上空結果、格式錯誤與環境不可用案例。測試前先約定品質與延遲目標;不宣稱已量測準確率、成本或速度。 |
| 操作範圍 | 選定 Tasks 模型的物件偵測示意契約;其他任務會回傳不同結構。未啟用攝影機或執行模型。 |
可一併評估的路線: LiteRT
開發評估
開發構想規格・串接尚未實測
接口能力依據官方文件或程式庫;以下產品方向、輸入、交付與驗收條件則是我們的開發評估。
估算可交付產品前,需共同驗證執行環境、資料結構或硬體。
記錄產品瀏覽、官方文件點擊、規格下載與技術 Hub 點擊。這些是事件次數,不等於獨立人數或已完成串接。
本次可行性評估依實作條件判斷;尚未給定流量排名或交期承諾。