
당신은 다시는 Qwen3.6을 사용하지 않게 될 것입니다. 가장 과소평가된 모델.
요약
InternScience가 새로운 35B MoE 에이전트 모델인 'Agents-A1'을 출시했습니다. 이 모델은 체급 대비 뛰어난 성능을 바탕으로 Qwen3.6 및 DeepSeek V4 Pro 등을 능가하며, 매우 빠른 추론 속도를 제공합니다.
핵심 포인트
- 35B MoE 구조를 가진 고성능 에이전트 모델 출시
- Qwen3.6 및 DeepSeek V4 Pro 대비 우수한 성능 기록
- Llama.cpp 및 APEX 양자화 적용 시 매우 빠른 TPS 제공
- 35B 모델 외에 4B Dense 모델도 함께 공개됨
InternScience가 "Agent A1"이라는 새로운 모델을 출시했습니다. Agents-A1은 체급을 훨씬 뛰어넘는 성능을 보여주는 35B Mixture-of-Experts (MoE) 에이전트 모델입니다. 이 모델은 Qwen3.6을 이길 뿐만 아니라, 일부 시나리오에서는 DeepSeek V4 Pro와 Kimi 2.6마저 능가합니다. 단 35B-a3b라는 점을 고려하면 정말 놀라운 수준입니다. 가장 좋은 점은 속도가 매우 빠르다는 것입니다.
성능:
GPU: Rtx 5070 ti OC
CPU: I9-14900k (튜닝됨)
RAM: Corsair vengeance 64gb 5200mt ddr5
백엔드 (Backend): Llama.cpp server
리포지토리 (본인 사례): SC117/Agents-A1-Uncensored-MTP-APEX-GGUF
양자화 (Quantization): APEX Compact
TPS: 평균 약 ~ 97 tps
안정성 (Stability): 2026년 6월 26일에 출시되었으므로 현재 상당히 안정적일 것입니다. 제가 직접 테스트해 보았을 때 정말 경이로웠습니다. 리뷰 또한 매우 좋습니다.
새로운 출시: 그들은 4b dense 모델도 출시했지만, 제 생각에는 그렇게 매력적이지는 않습니다. 더 자세히 테스트해 보겠지만, 관심이 있다면 확인해 보세요:
35b MoE : https://huggingface.co/InternScience/Agents-A1
4b Dense : https://huggingface.co/InternScience/Agents-A1-4B
/u/Possible_Grocery8079에 의해 제출됨 [link] [comments]
AI 자동 생성 콘텐츠
본 콘텐츠는 r/LocalLLaMA의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기