Lỗi nguy hiểm nhất của workflow AI không phải là lỗi trực tiếp.


Mà là mô hình chính bị treo, phương án dự phòng cũng không thành,
nhưng hệ thống vẫn xuất ra một đoạn kết quả trông có vẻ hoàn chỉnh, khiến người ta tưởng rằng đã làm xong.
Tôi đã vấp phải một lần: khi xử lý tin tức hằng ngày, mô hình chính chạy đến 60 giây thì bị cắt, dự phòng cũng không thành công, cuối cùng vẫn nhận được một bản trích xuất trông rất “đúng bài”.
Vấn đề không nằm ở việc “đổi đường rồi thử lại”, mà nằm ở chỗ sau khi đổi đường thì không ai nói rõ ràng.
Sau đó, tôi thêm cho mỗi lần hoàn tất ba loại biên nhận (ack):
thiếu một trong số đó thì chỉ có thể đánh dấu “đang chờ xác minh”, không được đánh dấu “hoàn tất”:
1. Mục thực tế đã dùng cuối cùng: ____ (mô hình nào / dịch vụ nào)
2. Kết quả của mỗi lần thử: ____ (thành công / hết thời gian / lỗi)
3. Trạng thái đầu ra hiện tại: ____ (tạo bình thường / hạ cấp rõ ràng / thất bại)
Đổi đường được, nhưng phải được ghi vào kết quả và có thể kiểm tra lại. Hoàn tất trong im lặng còn nguy hiểm hơn cả việc báo lỗi.
Xem bản gốc
post-image
Trang này có thể chứa nội dung của bên thứ ba, được cung cấp chỉ nhằm mục đích thông tin (không phải là tuyên bố/bảo đảm) và không được coi là sự chứng thực cho quan điểm của Gate hoặc là lời khuyên về tài chính hoặc chuyên môn. Xem Tuyên bố từ chối trách nhiệm để biết chi tiết.
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
Bình luận
Thêm một bình luận
Thêm một bình luận
Không có bình luận
  • Đã ghim