
검열되지 않은 멀티 모델 출시: MTP가 포함된 LongCat-Flash-Lite, Jamba2-Mini
요약
MTP(Multi-Token Prediction) 기술이 적용된 LongCat-Flash-Lite, Jamba2-Mini, Nikusui 등 검열을 해제한 멀티 모델들을 출시했습니다. 각 모델의 거부율을 획기적으로 낮추었으며, 이를 지원하기 위한 최적화된 llama.cpp 포크와 GGUF 파일도 함께 제공합니다.
핵심 포인트
- MTP 기술이 포함된 LongCat-Flash-Lite(69B) 및 Jamba2-Mini(52B) 출시
- Heretic 기법을 통해 모델의 거부율(Refusal Rate)을 대폭 낮춤
- LongCat 모델 구동을 위한 전용 llama.cpp 포크 및 GGUF 파일 제공
- Nikusui-v1 모델의 검열 해제 버전 및 27B 모델 공개
지난 한 달 동안 커뮤니티에 흥미로운 결과물들을 선보이기 위해 열심히 작업해 왔습니다. 우선, 이전에 검열된 적이 없었던 MTPs(Multi-Token Prediction)가 포함된 LongCat-Flash-Lite Uncensored Heretic를 소개합니다. 이 모델은 69B-A3B 모델이며, Heretic에서 작동하도록 만드는 데 오랜 시간을 투자했습니다. 그 후 이를 지원할 뿐만 아니라 제가 찾아서 수정할 수 있는 최대한 많은 문제들을 해결하여 최적화한 llama.cpp 포크(fork)를 제작했습니다. 이 모델은 llama.cpp에서 지원이 전혀 되지 않으므로, GGUF 파일을 로드하려면 여기에서 찾을 수 있는 저의 포크를 사용해야 합니다: https://github.com/erm14254/llama.cpp-minimax-m3-combined/tree/longcat-mtp. llama-server.exe를 통해 모델을 로드해야 하며, llama-ui를 통해 상호작용할 수 있습니다. 모델 링크는 다음과 같습니다: Safetensors: https://huggingface.co/llmfan46/LongCat-Flash-Lite-uncensored-heretic-Native-MTP-Preserved GGUFs: https://huggingface.co/llmfan46/LongCat-Flash-Lite-uncensored-heretic-Native-MTP-Preserved-GGUF. 순정(vanilla) 베이스 모델은 100/100의 거부율을 보일 정도로 매우 검열되어 있었으나, 저는 이를 9/100의 거부율까지 낮출 수 있었습니다.
다음은 Jamba2-Mini Ultra Uncensored Heretic입니다. 이 모델 역시 이전에 검열된 적이 없는 또 다른 모델로, 52B 파라미터를 가진 하이브리드 Mamba 모델입니다. 이 모델은 메인라인(mainline) llama.cpp에서 지원되므로 GGUF를 만드는 것은 쉬웠지만, 순정 Heretic은 이를 지원하지 않아 지원 기능을 추가하는 데 몇 시간을 소비해야 했습니다. 모델 링크는 다음과 같습니다: Safetensors: https://huggingface.co/llmfan46/AI21-Jamba2-Mini-ultra-uncensored-heretic GGUFs: https://huggingface.co/llmfan46/AI21-Jamba2-Mini-ultra-uncensored-heretic-GGUF. 순정 모델은 97/100의 거부율을 가지고 있었으나, 저는 이를 4/100의 거부율까지 낮출 수 있었습니다.
---------------------------------------- 그 다음으로는 Extraaltodeus가 출시한 모델의 간단한 검열되지 않은 (uncensored) 버전인 Nikusui-v1-9B Uncensored Heretic with MTPs가 있습니다. 이 모델은 모델 카드 (Model Card) 페이지에는 "검열되지 않음 (uncensored)"라고 기재되어 있지만, 실제 거부율이 96/100에 달하기 때문에 사실상 그렇지 않습니다. 그래서 저는 Heretic을 사용하여 검열을 해제하였고 거부율을 11/100까지 낮추었습니다. 모델 링크는 여기서 확인하실 수 있습니다: Safetensors: https://huggingface.co/llmfan46/Qwen3.5-9B-Nikusui-v1-Uncensored-Heretic-Native-MTP-Preserved GGUFs: https://huggingface.co/llmfan46/Qwen3.5-9B-Nikusui-v1-Uncensored-Heretic-Native-MTP-Preserved-GGUF ---------------------------------------- 마지막으로, 저는 Nikusui의 저만의 버전을 만들었습니다. 바로 Nikusui-v1-27B Uncensored Heretic with MTPs 입니다! 저는 이 모델에 관심이 있었지만, 12B-9B-4B-2B 등과 같이 파라미터 (parameters) 수가 매우 적은 모델을 사용하는 사람은 아니기에, Extraaltodeus의 J-Wash 도구들을 Nikusui-v1 설정과 함께 사용하여 저만의 27B 버전을 만들기로 결정했습니다! 모델 링크는 여기서 확인하실 수 있습니다: Safetensors: https://huggingface.co/llmfan46/Qwen3.5-27B-Nikusui-v1-Uncensored-Heretic-Native-MTP-Preserved GGUFs: https://huggingface.co/llmfan46/Qwen3.5-27B-Nikusui-v1-Uncensored-Heretic-Native-MTP-Preserved-GGUF ---------------------------------------- 이번 소식은 여기까지입니다! 평소와 같이 저의 모든 모델은 여기서 확인하실 수 있습니다: HuggingFace-LLMFan46 만약 제 작업물이 마음에 드시고 제 모델들이 유용하다고 생각하신다면, Ko-fi를 통해 저를 후원해 주시면 정말 감사하겠습니다: https://ko-fi.com/llmfan46 /u/LLMFan46에 의해 제출됨 [link] [comments]
AI 자동 생성 콘텐츠
본 콘텐츠는 r/LocalLLaMA의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기