Qwen3.8-27B-Uncensored-MLX - 애플 실리콘용 검열 제거 버전

2 days ago 5

orcarouter가 Qwen3.8-27B의 거부(refusal) 방향을 제거한 abliterated 버전으로, 원본 모델이 거절하던 유해·불법·공격적 요청에도 응답하도록 안전 정렬을 크게 제거한 연구용 모델 Apple Silicon의 MLX에서 실행하도록 변환됐으며 2/4/6/8-bit 양자화를 제공, 4-bit는 약 15GB로 24GB Mac에서 실행 가능하고 기본 권장 버전으로 제시됨 비전, 262K 컨텍스트, Tool Calling, 추론 기능을 유지하며 4/6/8-bit에서는 텍스트·코드·중국어·이미지 테스트와 거부 없는 응답을 확인했다고 밝힘 2-bit는 약 8.7GB로 16GB Mac에도 들어가지만 반복·깨진 출력 등 생성 품질이 심각하게 저하돼 실제 사용보다 극단적 압축 보관용으로만 제공 안전장치가 사실상 제거됐기 때문에 일반 사용자나 Production 배포용이 아니라 AI 안전성·해석 가능성·거부 메커니즘·Red Teaming 연구를 대상으로 하며, 배포 시 별도의 Moderation과 안전 계층을 직접 구성해야 함 Qwen3.8-27B에서 거부 메커니즘을 제거 Qwen/Qwen3.8-27B를 기반으로 Abliteration을 적용해 안전 정렬의 거부 방향을 Residual Stream에서 제거한 변형 결과적으로 원본이 거절할 수 있는 악성코드, Exploit, 무기, 사기 등 위험하거나 불법적인 요청에도 응답할 수 있다고 명시함 Jailbreak이나 안전성 Probe에서 거부하지 않는 것은 안전성 평가를 통과했다는 의미가 아니라, 애초에 거부 기능이 제거됐기 때문 허위 정보, 명예훼손성·편향적·공격적인 답변을 높은 확신으로 생성할 가능성도 경고함 비전과 Tool Calling까지 그대로 유지되므로 위험 범위도 단순 텍스트 생성을 넘어 이미지 이해와 Agent 작업까지 확장됨 Apple Silicon용 MLX 양자화 언어 모델의 Linear Weight를 MLX affine 방식으로 양자화하고, Vision Tower·Norm·Linear Attention의 conv1d는 BF16으로 유지함 네 가지 정밀도를 제공함 버전 크기 권장 Mac RAM 특성 8-bit 약 27.5GB 32GB 거의 무손실, 품질 우선 6-bit 약 22GB 24~32GB 품질/크기 균형 4-bit 약 15GB 24GB 기본 권장 2-bit 약 8.7GB 16GB 품질 심각하게 저하 4-bit의 수치적 Fidelity...

Read Entire Article