Phát hiện, theo dõi và phân loại đối tượng bằng mô hình phân loại tuỳ chỉnh trên Android

Bạn có thể dùng Bộ công cụ học máy để phát hiện và theo dõi các đối tượng trong các khung hình video liên tiếp.

Khi bạn truyền hình ảnh đến Bộ công cụ học máy, công cụ này sẽ phát hiện tối đa 5 đối tượng trong hình ảnh đó cùng với vị trí của mỗi đối tượng trong hình ảnh. Khi phát hiện đối tượng trong luồng video, mỗi đối tượng có một mã nhận dạng duy nhất mà bạn có thể dùng để theo dõi đối tượng giữa các khung hình.

Bạn có thể sử dụng mô hình phân loại hình ảnh tuỳ chỉnh để phân loại những đối tượng . Vui lòng tham khảo bài viết Mô hình tuỳ chỉnh sử dụng Bộ công cụ học máy để hướng dẫn về yêu cầu về khả năng tương thích với mô hình, nơi có thể tìm thấy các mô hình được huấn luyện trước, và cách huấn luyện mô hình của riêng bạn.

Có 2 cách để tích hợp mô hình tuỳ chỉnh. Bạn có thể nhóm mô hình theo đặt tập dữ liệu đó vào thư mục tài sản của ứng dụng hoặc bạn có thể tự động tải xuống từ Firebase. Bảng sau đây so sánh hai lựa chọn.

Mô hình theo gói	Mô hình được lưu trữ
Mô hình này nằm trong tệp APK của ứng dụng, giúp tăng kích thước của mô hình.	Mô hình này không thuộc APK của bạn. Được lưu trữ bằng cách tải lên Công nghệ học máy của Firebase.
Mô hình này sẽ dùng được ngay lập tức, ngay cả khi thiết bị Android không có kết nối mạng	Mô hình này được tải xuống theo yêu cầu
Không cần tạo dự án Firebase	Cần có một dự án Firebase
Bạn phải xuất bản lại ứng dụng để cập nhật mô hình	Cập nhật mô hình mà không cần xuất bản lại ứng dụng
Không có tính năng Thử nghiệm A/B tích hợp sẵn	Thử nghiệm A/B dễ dàng bằng Cấu hình từ xa Firebase

Dùng thử

Xem ứng dụng bắt đầu nhanh về thị giác để có ví dụ về cách sử dụng mô hình đi kèm và ứng dụng khởi động nhanh automl cho ví dụ về cách sử dụng mô hình được lưu trữ.
Xem trang giới thiệu Material Design để triển khai toàn diện API này.

Trước khi bắt đầu

Trong tệp build.gradle cấp dự án, hãy nhớ đưa vào Kho lưu trữ Maven của Google trong cả buildscript và allprojects mục.

Thêm các phần phụ thuộc cho thư viện Android Bộ công cụ học máy vào mô-đun của bạn tệp gradle cấp ứng dụng, thường là app/build.gradle:

Để nhóm mô hình với ứng dụng của bạn:

dependencies {
  // ...
  // Object detection & tracking feature with custom bundled model
  implementation 'com.google.mlkit:object-detection-custom:17.0.2'
}

Để tự động tải một mô hình xuống từ Firebase, hãy thêm linkFirebase phần phụ thuộc:

dependencies {
  // ...
  // Object detection & tracking feature with model downloaded
  // from firebase
  implementation 'com.google.mlkit:object-detection-custom:17.0.2'
  implementation 'com.google.mlkit:linkfirebase:17.0.0'
}

Nếu bạn muốn tải một mô hình xuống, hãy đảm bảo bạn thêm Firebase vào dự án Android của bạn, nếu bạn chưa làm như vậy. Bạn không bắt buộc phải thực hiện việc này khi gói mô hình.

1. Tải mô hình

Định cấu hình nguồn mô hình cục bộ

Cách đóng gói mô hình với ứng dụng:

Sao chép tệp mô hình (thường kết thúc bằng .tflite hoặc .lite) vào tệp mô hình của ứng dụng Thư mục assets/. (Trước tiên, bạn có thể cần tạo thư mục bằng cách nhấp chuột phải vào thư mục app/, rồi nhấp vào Mới > Thư mục > Thư mục thành phần.)
Sau đó, hãy thêm đoạn mã sau vào tệp build.gradle của ứng dụng để đảm bảo Gradle không nén tệp mô hình khi tạo ứng dụng:
```
android {
    // ...
    aaptOptions {
        noCompress "tflite"
        // or noCompress "lite"
    }
}
```
Tệp mô hình sẽ có trong gói ứng dụng và được cung cấp cho Bộ công cụ học máy dưới dạng nội dung thô.

Lưu ý: kể từ phiên bản 4.1 của trình bổ trợ Android cho Gradle, .tflite sẽ là được thêm vào danh sách noCompress theo mặc định và không cần danh sách nêu trên nữa.
Tạo đối tượng LocalModel, chỉ định đường dẫn đến tệp mô hình:
Kotlin
val localModel = LocalModel.Builder() .setAssetFilePath("model.tflite") // or .setAbsoluteFilePath(absolute file path to model file) // or .setUri(URI to model file) .build()
Java
LocalModel localModel = new LocalModel.Builder() .setAssetFilePath("model.tflite") // or .setAbsoluteFilePath(absolute file path to model file) // or .setUri(URI to model file) .build();
Lưu ý: ứng dụng nhắm đến Android 11 (API cấp 30) không còn truy cập được vào tệp từ bộ nhớ ngoài nhờ Bản cập nhật bộ nhớ trong Android 11.
Lưu ý: nếu bạn có mô hình đã được huấn luyện bằng AutoML Vision Edge trong Firebase (không phải Google Cloud), thì các tính năng trên có thể không hoạt động. Vui lòng làm theo hướng dẫn di chuyển để xem hướng dẫn.

Định cấu hình nguồn mô hình được lưu trữ trên Firebase

Để sử dụng mô hình được lưu trữ từ xa, hãy tạo đối tượng CustomRemoteModel bằng cách FirebaseModelSource, chỉ định tên mà bạn đã chỉ định cho mô hình khi bạn đã xuất bản nội dung đó:

Kotlin

// Specify the name you assigned in the Firebase console.
val remoteModel =
    CustomRemoteModel
        .Builder(FirebaseModelSource.Builder("your_model_name").build())
        .build()

Java

// Specify the name you assigned in the Firebase console.
CustomRemoteModel remoteModel =
    new CustomRemoteModel
        .Builder(new FirebaseModelSource.Builder("your_model_name").build())
        .build();

Sau đó, bắt đầu tác vụ tải mô hình xuống, chỉ định các điều kiện mà theo đó mà bạn muốn cho phép tải xuống. Nếu kiểu máy này không có trên thiết bị hoặc nếu là kiểu máy mới hơn phiên bản của mô hình sẵn có, tác vụ sẽ tải xuống không đồng bộ mô hình từ Firebase:

Kotlin

val downloadConditions = DownloadConditions.Builder()
    .requireWifi()
    .build()
RemoteModelManager.getInstance().download(remoteModel, downloadConditions)
    .addOnSuccessListener {
        // Success.
    }

Java

DownloadConditions downloadConditions = new DownloadConditions.Builder()
        .requireWifi()
        .build();
RemoteModelManager.getInstance().download(remoteModel, downloadConditions)
        .addOnSuccessListener(new OnSuccessListener() {
            @Override
            public void onSuccess(@NonNull Task task) {
                // Success.
            }
        });

Nhiều ứng dụng bắt đầu tác vụ tải xuống trong mã khởi chạy, nhưng bạn có thể làm như vậy bất cứ lúc nào trước khi cần sử dụng mô hình.

2. Định cấu hình trình phát hiện đối tượng

Sau khi bạn định cấu hình các nguồn mô hình, hãy định cấu hình trình phát hiện đối tượng cho trường hợp sử dụng với đối tượng CustomObjectDetectorOptions. Bạn có thể thay đổi các chế độ cài đặt sau:

Cài đặt trình phát hiện đối tượng
Chế độ phát hiện	`STREAM_MODE` (mặc định) \| `SINGLE_IMAGE_MODE` Trong `STREAM_MODE` (mặc định), trình phát hiện đối tượng sẽ chạy với độ trễ thấp, nhưng có thể tạo ra kết quả không hoàn chỉnh (chẳng hạn như hộp giới hạn không xác định hoặc nhãn danh mục) ở vài trang đầu các lệnh gọi của trình phát hiện. Ngoài ra, trong `STREAM_MODE`, trình phát hiện gán mã theo dõi cho các đối tượng mà bạn có thể sử dụng để theo dõi đối tượng trên các khung. Sử dụng chế độ này khi bạn muốn theo dõi đối tượng hoặc khi độ trễ thấp là quan trọng, chẳng hạn như khi xử lý theo thời gian thực. Trong `SINGLE_IMAGE_MODE`, trình phát hiện đối tượng sẽ trả về kết quả sau khi xác định hộp giới hạn của đối tượng. Nếu bạn bật phân loại, nó cũng trả về kết quả sau giới hạn và nhãn danh mục đều có sẵn. Do vậy, độ trễ phát hiện của bạn có thể cao hơn. Ngoài ra, trong `SINGLE_IMAGE_MODE`, mã theo dõi chưa được chỉ định. Sử dụng chế độ này nếu độ trễ không quan trọng và bạn không muốn xử lý một phần kết quả.
Phát hiện và theo dõi nhiều đối tượng	`false` (mặc định) \| `true` Phát hiện và theo dõi tối đa 5 đối tượng hay chỉ phát hiện tối đa đối tượng đối tượng nổi bật (mặc định).
Phân loại đối tượng	`false` (mặc định) \| `true` Liệu có phân loại các đối tượng được phát hiện bằng cách sử dụng mô hình thuật toán phân loại tuỳ chỉnh. Cách sử dụng phân loại tuỳ chỉnh mô hình, bạn cần đặt giá trị này thành `true`.
Ngưỡng tin cậy của hoạt động phân loại	Điểm tin cậy tối thiểu của các nhãn được phát hiện. Nếu bạn không đặt chính sách này, ngưỡng phân loại do siêu dữ liệu của mô hình chỉ định sẽ được dùng. Nếu mô hình không chứa bất kỳ siêu dữ liệu nào hoặc siêu dữ liệu không có Google sẽ chỉ định một ngưỡng phân loại, thì ngưỡng mặc định là 0.0 sẽ được đã sử dụng.
Số nhãn tối đa cho mỗi đối tượng	Số nhãn tối đa trên mỗi đối tượng mà trình phát hiện sẽ lợi nhuận. Nếu bạn không đặt chính sách này, giá trị mặc định là 10 sẽ được sử dụng.

API theo dõi và phát hiện đối tượng được tối ưu hoá cho hai mục đích sử dụng cốt lõi này trường hợp:

Phát hiện trực tiếp và theo dõi đối tượng nổi bật nhất trong máy ảnh kính ngắm.
Phát hiện nhiều đối tượng trong một hình ảnh tĩnh.

Để định cấu hình API cho những trường hợp sử dụng này bằng mô hình theo gói cục bộ, hãy làm như sau:

Kotlin

// Live detection and tracking
val customObjectDetectorOptions =
        CustomObjectDetectorOptions.Builder(localModel)
        .setDetectorMode(CustomObjectDetectorOptions.STREAM_MODE)
        .enableClassification()
        .setClassificationConfidenceThreshold(0.5f)
        .setMaxPerObjectLabelCount(3)
        .build()

// Multiple object detection in static images
val customObjectDetectorOptions =
        CustomObjectDetectorOptions.Builder(localModel)
        .setDetectorMode(CustomObjectDetectorOptions.SINGLE_IMAGE_MODE)
        .enableMultipleObjects()
        .enableClassification()
        .setClassificationConfidenceThreshold(0.5f)
        .setMaxPerObjectLabelCount(3)
        .build()

val objectDetector =
        ObjectDetection.getClient(customObjectDetectorOptions)

Java

// Live detection and tracking
CustomObjectDetectorOptions customObjectDetectorOptions =
        new CustomObjectDetectorOptions.Builder(localModel)
                .setDetectorMode(CustomObjectDetectorOptions.STREAM_MODE)
                .enableClassification()
                .setClassificationConfidenceThreshold(0.5f)
                .setMaxPerObjectLabelCount(3)
                .build();

// Multiple object detection in static images
CustomObjectDetectorOptions customObjectDetectorOptions =
        new CustomObjectDetectorOptions.Builder(localModel)
                .setDetectorMode(CustomObjectDetectorOptions.SINGLE_IMAGE_MODE)
                .enableMultipleObjects()
                .enableClassification()
                .setClassificationConfidenceThreshold(0.5f)
                .setMaxPerObjectLabelCount(3)
                .build();

ObjectDetector objectDetector =
    ObjectDetection.getClient(customObjectDetectorOptions);

Nếu có mô hình được lưu trữ từ xa, bạn sẽ phải kiểm tra xem mô hình đó đã được tải xuống trước khi chạy nó. Bạn có thể kiểm tra trạng thái tải mô hình xuống bằng cách sử dụng phương thức isModelDownloaded() của trình quản lý mô hình.

Mặc dù bạn chỉ phải xác nhận điều này trước khi chạy trình phát hiện, nhưng nếu bạn có cả mô hình được lưu trữ từ xa và mô hình được gói cục bộ, ý nghĩa để thực hiện kiểm tra này khi tạo thực thể cho trình phát hiện hình ảnh: tạo một trình phát hiện của bạn từ mô hình từ xa nếu đã tải xuống và từ mô hình khác.

Kotlin

RemoteModelManager.getInstance().isModelDownloaded(remoteModel)
    .addOnSuccessListener { isDownloaded ->
    val optionsBuilder =
        if (isDownloaded) {
            CustomObjectDetectorOptions.Builder(remoteModel)
        } else {
            CustomObjectDetectorOptions.Builder(localModel)
        }
    val customObjectDetectorOptions = optionsBuilder
            .setDetectorMode(CustomObjectDetectorOptions.SINGLE_IMAGE_MODE)
            .enableClassification()
            .setClassificationConfidenceThreshold(0.5f)
            .setMaxPerObjectLabelCount(3)
            .build()
    val objectDetector =
        ObjectDetection.getClient(customObjectDetectorOptions)
}

Java

RemoteModelManager.getInstance().isModelDownloaded(remoteModel)
    .addOnSuccessListener(new OnSuccessListener() {
        @Override
        public void onSuccess(Boolean isDownloaded) {
            CustomObjectDetectorOptions.Builder optionsBuilder;
            if (isDownloaded) {
                optionsBuilder = new CustomObjectDetectorOptions.Builder(remoteModel);
            } else {
                optionsBuilder = new CustomObjectDetectorOptions.Builder(localModel);
            }
            CustomObjectDetectorOptions customObjectDetectorOptions = optionsBuilder
                .setDetectorMode(CustomObjectDetectorOptions.SINGLE_IMAGE_MODE)
                .enableClassification()
                .setClassificationConfidenceThreshold(0.5f)
                .setMaxPerObjectLabelCount(3)
                .build();
            ObjectDetector objectDetector =
                ObjectDetection.getClient(customObjectDetectorOptions);
        }
});

Nếu chỉ có một mô hình được lưu trữ từ xa, bạn nên tắt tính năng liên quan đến mô hình đó chức năng (ví dụ: chuyển sang màu xám hoặc ẩn một phần giao diện người dùng) cho đến khi bạn xác nhận mô hình đã được tải xuống. Bạn có thể thực hiện việc này bằng cách đính kèm một trình nghe đối với phương thức download() của trình quản lý mô hình:

Kotlin

RemoteModelManager.getInstance().download(remoteModel, conditions)
    .addOnSuccessListener {
        // Download complete. Depending on your app, you could enable the ML
        // feature, or switch from the local model to the remote model, etc.
    }

Java

RemoteModelManager.getInstance().download(remoteModel, conditions)
        .addOnSuccessListener(new OnSuccessListener() {
            @Override
            public void onSuccess(Void v) {
              // Download complete. Depending on your app, you could enable
              // the ML feature, or switch from the local model to the remote
              // model, etc.
            }
        });

3. Chuẩn bị hình ảnh đầu vào

Tạo một đối tượng InputImage từ hình ảnh của bạn. Trình phát hiện đối tượng chạy trực tiếp từ Bitmap, NV21 ByteBuffer hoặc YUV_420_888 media.Image. Việc tạo InputImage từ các nguồn đó sẽ được đề xuất nếu bạn có quyền truy cập trực tiếp vào một trong các nền tảng đó. Nếu bạn tạo một InputImage từ các nguồn khác, chúng tôi sẽ xử lý việc chuyển đổi nội bộ cho cho bạn và điều đó có thể kém hiệu quả hơn.

Bạn có thể tạo một InputImage đối tượng từ các nguồn khác nhau, mỗi nguồn được giải thích ở bên dưới.

Sử dụng `media.Image`

Cách tạo InputImage từ đối tượng media.Image, chẳng hạn như khi bạn chụp ảnh từ một camera của thiết bị, hãy truyền đối tượng media.Image và xoay thành InputImage.fromMediaImage().

Nếu bạn sử dụng Thư viện CameraX, OnImageCapturedListener và Các lớp ImageAnalysis.Analyzer tính toán giá trị xoay cho bạn.

Kotlin

private class YourImageAnalyzer : ImageAnalysis.Analyzer {

    override fun analyze(imageProxy: ImageProxy) {
        val mediaImage = imageProxy.image
        if (mediaImage != null) {
            val image = InputImage.fromMediaImage(mediaImage, imageProxy.imageInfo.rotationDegrees)
            // Pass image to an ML Kit Vision API
            // ...
        }
    }
}

Java

private class YourAnalyzer implements ImageAnalysis.Analyzer {

    @Override
    public void analyze(ImageProxy imageProxy) {
        Image mediaImage = imageProxy.getImage();
        if (mediaImage != null) {
          InputImage image =
                InputImage.fromMediaImage(mediaImage, imageProxy.getImageInfo().getRotationDegrees());
          // Pass image to an ML Kit Vision API
          // ...
        }
    }
}

Nếu không sử dụng thư viện máy ảnh cung cấp độ xoay của hình ảnh, bạn có thể tính tỷ lệ khung hình dựa trên độ xoay của thiết bị và hướng của máy ảnh cảm biến trong thiết bị:

Kotlin

private val ORIENTATIONS = SparseIntArray()

init {
    ORIENTATIONS.append(Surface.ROTATION_0, 0)
    ORIENTATIONS.append(Surface.ROTATION_90, 90)
    ORIENTATIONS.append(Surface.ROTATION_180, 180)
    ORIENTATIONS.append(Surface.ROTATION_270, 270)
}

/**
 * Get the angle by which an image must be rotated given the device's current
 * orientation.
 */
@RequiresApi(api = Build.VERSION_CODES.LOLLIPOP)
@Throws(CameraAccessException::class)
private fun getRotationCompensation(cameraId: String, activity: Activity, isFrontFacing: Boolean): Int {
    // Get the device's current rotation relative to its "native" orientation.
    // Then, from the ORIENTATIONS table, look up the angle the image must be
    // rotated to compensate for the device's rotation.
    val deviceRotation = activity.windowManager.defaultDisplay.rotation
    var rotationCompensation = ORIENTATIONS.get(deviceRotation)

    // Get the device's sensor orientation.
    val cameraManager = activity.getSystemService(CAMERA_SERVICE) as CameraManager
    val sensorOrientation = cameraManager
            .getCameraCharacteristics(cameraId)
            .get(CameraCharacteristics.SENSOR_ORIENTATION)!!

    if (isFrontFacing) {
        rotationCompensation = (sensorOrientation + rotationCompensation) % 360
    } else { // back-facing
        rotationCompensation = (sensorOrientation - rotationCompensation + 360) % 360
    }
    return rotationCompensation
}MLKitVisionImage.kt

Java

private static final SparseIntArray ORIENTATIONS = new SparseIntArray();
static {
    ORIENTATIONS.append(Surface.ROTATION_0, 0);
    ORIENTATIONS.append(Surface.ROTATION_90, 90);
    ORIENTATIONS.append(Surface.ROTATION_180, 180);
    ORIENTATIONS.append(Surface.ROTATION_270, 270);
}

/**
 * Get the angle by which an image must be rotated given the device's current
 * orientation.
 */
@RequiresApi(api = Build.VERSION_CODES.LOLLIPOP)
private int getRotationCompensation(String cameraId, Activity activity, boolean isFrontFacing)
        throws CameraAccessException {
    // Get the device's current rotation relative to its "native" orientation.
    // Then, from the ORIENTATIONS table, look up the angle the image must be
    // rotated to compensate for the device's rotation.
    int deviceRotation = activity.getWindowManager().getDefaultDisplay().getRotation();
    int rotationCompensation = ORIENTATIONS.get(deviceRotation);

    // Get the device's sensor orientation.
    CameraManager cameraManager = (CameraManager) activity.getSystemService(CAMERA_SERVICE);
    int sensorOrientation = cameraManager
            .getCameraCharacteristics(cameraId)
            .get(CameraCharacteristics.SENSOR_ORIENTATION);

    if (isFrontFacing) {
        rotationCompensation = (sensorOrientation + rotationCompensation) % 360;
    } else { // back-facing
        rotationCompensation = (sensorOrientation - rotationCompensation + 360) % 360;
    }
    return rotationCompensation;
}

Sau đó, hãy truyền đối tượng media.Image và giá trị độ xoay thành InputImage.fromMediaImage():

Kotlin

val image = InputImage.fromMediaImage(mediaImage, rotation)MLKitVisionImage.kt

Java

InputImage image = InputImage.fromMediaImage(mediaImage, rotation);

Sử dụng URI tệp

Cách tạo InputImage từ một URI tệp, hãy chuyển ngữ cảnh ứng dụng và URI tệp đến InputImage.fromFilePath(). Điều này rất hữu ích khi bạn sử dụng ý định ACTION_GET_CONTENT để nhắc người dùng chọn một bức ảnh trong ứng dụng thư viện của họ.

Kotlin

val image: InputImage
try {
    image = InputImage.fromFilePath(context, uri)
} catch (e: IOException) {
    e.printStackTrace()
}MLKitVisionImage.kt

Java

InputImage image;
try {
    image = InputImage.fromFilePath(context, uri);
} catch (IOException e) {
    e.printStackTrace();
}

Sử dụng `ByteBuffer` hoặc `ByteArray`

Cách tạo InputImage đối tượng từ ByteBuffer hoặc ByteArray, trước tiên hãy tính hình ảnh độ xoay như mô tả trước đây cho đầu vào media.Image. Sau đó, hãy tạo đối tượng InputImage bằng vùng đệm hoặc mảng, cùng với đối tượng chiều cao, chiều rộng, định dạng mã hoá màu và độ xoay:

Kotlin

val image = InputImage.fromByteBuffer(
        byteBuffer,
        /* image width */ 480,
        /* image height */ 360,
        rotationDegrees,
        InputImage.IMAGE_FORMAT_NV21 // or IMAGE_FORMAT_YV12
)MLKitVisionImage.kt
// Or:
val image = InputImage.fromByteArray(
        byteArray,
        /* image width */ 480,
        /* image height */ 360,
        rotationDegrees,
        InputImage.IMAGE_FORMAT_NV21 // or IMAGE_FORMAT_YV12
)
MLKitVisionImage.kt

Java

InputImage image = InputImage.fromByteBuffer(byteBuffer,
        /* image width */ 480,
        /* image height */ 360,
        rotationDegrees,
        InputImage.IMAGE_FORMAT_NV21 // or IMAGE_FORMAT_YV12
);MLKitVisionImage.java
// Or:
InputImage image = InputImage.fromByteArray(
        byteArray,
        /* image width */480,
        /* image height */360,
        rotation,
        InputImage.IMAGE_FORMAT_NV21 // or IMAGE_FORMAT_YV12
);MLKitVisionImage.java

Sử dụng `Bitmap`

Cách tạo InputImage qua đối tượng Bitmap, hãy khai báo sau:

Kotlin

val image = InputImage.fromBitmap(bitmap, 0)MLKitVisionImage.kt

Java

InputImage image = InputImage.fromBitmap(bitmap, rotationDegree);MLKitVisionImage.java

Hình ảnh được biểu thị bằng một đối tượng Bitmap cùng với độ xoay.

4. Chạy trình phát hiện đối tượng

Kotlin

objectDetector
    .process(image)
    .addOnFailureListener(e -> {...})
    .addOnSuccessListener(results -> {
        for (detectedObject in results) {
          // ...
        }
    });

Java

objectDetector
    .process(image)
    .addOnFailureListener(e -> {...})
    .addOnSuccessListener(results -> {
        for (DetectedObject detectedObject : results) {
          // ...
        }
    });

Lưu ý: Nếu bạn đang sử dụng API CameraX, hãy nhớ đóng ImageProxy khi sử dụng xong. ví dụ: bằng cách thêm OnCompleteListener vào Task được trả về từ process. Xem Ví dụ về lớp VisionProcessorBase trong ứng dụng mẫu khởi động nhanh.

5. Nhận thông tin về đối tượng được gắn nhãn

Nếu lệnh gọi đến process() thành công, danh sách DetectedObject sẽ được chuyển tới trình nghe thành công.

Mỗi DetectedObject chứa các thuộc tính sau:

Hộp giới hạn Rect cho biết vị trí của đối tượng trong hình ảnh.

Mã theo dõi Số nguyên xác định đối tượng trên các hình ảnh. Rỗng trong SINGLE_IMAGE_MODE.

Nhãn

Mô tả nhãn	Mô tả văn bản của nhãn. Chỉ được trả về nếu TensorFlow Siêu dữ liệu của mô hình thu gọn chứa nội dung mô tả về nhãn.
Chỉ mục nhãn	Chỉ mục của nhãn trong số tất cả các nhãn được hỗ trợ thuật toán phân loại.
Mức độ tin cậy của nhãn	Giá trị tin cậy của việc phân loại đối tượng.

Kotlin

// The list of detected objects contains one item if multiple
// object detection wasn't enabled.
for (detectedObject in results) {
    val boundingBox = detectedObject.boundingBox
    val trackingId = detectedObject.trackingId
    for (label in detectedObject.labels) {
      val text = label.text
      val index = label.index
      val confidence = label.confidence
    }
}

Java

// The list of detected objects contains one item if multiple
// object detection wasn't enabled.
for (DetectedObject detectedObject : results) {
  Rect boundingBox = detectedObject.getBoundingBox();
  Integer trackingId = detectedObject.getTrackingId();
  for (Label label : detectedObject.getLabels()) {
    String text = label.getText();
    int index = label.getIndex();
    float confidence = label.getConfidence();
  }
}

Đảm bảo trải nghiệm người dùng tuyệt vời

Để có trải nghiệm người dùng tốt nhất, hãy làm theo các nguyên tắc sau trong ứng dụng của bạn:

Việc phát hiện được đối tượng có thành công hay không còn phụ thuộc vào độ phức tạp trực quan của đối tượng. Trong Để được phát hiện, các đối tượng có một số ít đặc điểm trực quan có thể cần được chiếm phần lớn hình ảnh. Bạn nên cung cấp cho người dùng hướng dẫn về thu thập dữ liệu đầu vào phù hợp với loại đối tượng bạn muốn phát hiện.
Khi sử dụng tính năng phân loại, nếu bạn muốn phát hiện các đối tượng không nằm trong rõ ràng vào các danh mục được hỗ trợ, triển khai cách xử lý đặc biệt đối với các trường hợp .

Ngoài ra, hãy xem ứng dụng giới thiệu Material Design cho bộ công cụ học máy và Thiết kế Material Design Bộ sưu tập Mẫu cho các tính năng dựa trên công nghệ học máy.

Cải thiện hiệu suất

Nếu bạn muốn sử dụng tính năng phát hiện đối tượng trong ứng dụng theo thời gian thực, hãy làm theo các bước sau để đạt được tốc độ khung hình tốt nhất:

Khi bạn sử dụng chế độ truyền trực tuyến trong một ứng dụng thời gian thực, đừng sử dụng nhiều phát hiện vật thể, vì hầu hết các thiết bị sẽ không tạo ra được tốc độ khung hình thích hợp.
Nếu bạn sử dụng Camera hoặc API camera2, lệnh điều tiết đến trình phát hiện. Nếu một video mới khung hình sẽ xuất hiện trong khi trình phát hiện đang chạy, hãy bỏ khung đó. Xem Ví dụ về lớp VisionProcessorBase trong ứng dụng mẫu khởi động nhanh.
Nếu bạn sử dụng API CameraX, đảm bảo rằng chiến lược backpressure được đặt ở giá trị mặc định ImageAnalysis.STRATEGY_KEEP_ONLY_LATEST. Việc này giúp đảm bảo mỗi lần hệ thống chỉ gửi một hình ảnh để phân tích. Nếu các hình ảnh khác được tạo ra khi trình phân tích bận, chúng sẽ tự động bị loại bỏ và không được đưa vào hàng đợi của bạn. Sau khi hình ảnh đang được phân tích được đóng bằng cách gọi ImageProxy.close(), hình ảnh mới nhất tiếp theo sẽ được gửi.
Nếu bạn sử dụng đầu ra của trình phát hiện để phủ đồ hoạ lên hình ảnh đầu vào, trước tiên hãy lấy kết quả từ Bộ công cụ học máy, sau đó kết xuất hình ảnh và phủ lên trên trong một bước duy nhất. Kết xuất này hiển thị trên bề mặt màn hình một lần cho mỗi khung đầu vào. Xem CameraSourcePreview và Ví dụ về các lớp GraphicOverlay trong ứng dụng mẫu khởi động nhanh.
Nếu bạn sử dụng API Camera2, hãy chụp ảnh trong Định dạng ImageFormat.YUV_420_888. Nếu bạn sử dụng API Máy ảnh cũ, hãy chụp ảnh trong Định dạng ImageFormat.NV21.

Phát hiện, theo dõi và phân loại đối tượng bằng mô hình phân loại tuỳ chỉnh trên Android Sử dụng bộ sưu tập để sắp xếp ngăn nắp các trang Lưu và phân loại nội dung dựa trên lựa chọn ưu tiên của bạn.

Dùng thử

Trước khi bắt đầu

1. Tải mô hình

Định cấu hình nguồn mô hình cục bộ

Kotlin

Java

Định cấu hình nguồn mô hình được lưu trữ trên Firebase

Kotlin

Java

Kotlin

Java

2. Định cấu hình trình phát hiện đối tượng

Kotlin

Java

Kotlin

Java

Kotlin

Java

3. Chuẩn bị hình ảnh đầu vào

Sử dụng media.Image

Kotlin

Java

Kotlin

Java

Kotlin

Java

Sử dụng URI tệp

Kotlin

Java

Sử dụng ByteBuffer hoặc ByteArray

Kotlin

Java

Sử dụng Bitmap

Kotlin

Java

4. Chạy trình phát hiện đối tượng

Kotlin

Java

5. Nhận thông tin về đối tượng được gắn nhãn

Kotlin

Java

Đảm bảo trải nghiệm người dùng tuyệt vời

Cải thiện hiệu suất

Phát hiện, theo dõi và phân loại đối tượng bằng mô hình phân loại tuỳ chỉnh trên Android

Sử dụng `media.Image`

Sử dụng `ByteBuffer` hoặc `ByteArray`

Sử dụng `Bitmap`