Benchmark của Red Hat cho thấy các bộ phân loại nhỏ có thể sánh ngang LLM lớn trong việc phát hiện tấn công prompt injection
Theo các benchmark mới từ Red Hat, một mô hình chỉ với 200 triệu tham số đã đạt độ chính xác tương đương với một LLM 35 tỷ tham số khi làm nhiệm vụ đánh giá (judge) về prompt injection, đồng thời chạy nhanh hơn đáng kể.
