heretic tự động gỡ bỏ lớp kiểm duyệt (abliteration) khỏi mô hình ngôn ngữ mã nguồn mở một cách hoàn toàn tự động, không cần tinh chỉnh thủ công. Điểm nổi bật: biến một model bị “khoá” thành phiên bản trả lời cởi mở hơn, phục vụ nghiên cứu và tuỳ biến hành vi model.
Ứng dụng
- Nghiên cứu cơ chế alignment và giới hạn của mô hình mở.
- Tuỳ biến hành vi trợ lý cho ngữ cảnh sáng tạo/hư cấu người lớn hợp pháp.
- Kiểm thử độ an toàn (red-team) trên model đã gỡ rào.
Hướng kiếm tiền: Cung cấp dịch vụ tuỳ biến & đánh giá model theo yêu cầu ngách, kèm cảnh báo pháp lý rõ ràng.
⭐ 27.1k (ghi nhận) · nhóm: Cơ hội · license: AGPL-3.0
Được nhắc trong bản tin
Đi tiếp: Xem Tổng hợp giải pháp để đóng gói repo này thành dịch vụ.
