[{"data":1,"prerenderedAt":276},["ShallowReactive",2],{"docs-ko-/ko/docs/service/ai/local":3},{"id":4,"title":5,"body":6,"description":268,"extension":269,"meta":270,"navigation":271,"path":272,"seo":273,"stem":274,"__hash__":275},"docs_ko/ko/docs/service/ai/local.md","AI 서비스(로컬)",{"type":7,"value":8,"toc":257},"minimark",[9,13,17,24,29,32,37,40,44,47,50,53,57,61,64,67,71,74,78,136,138,141,149,152,159,165,168,171,174,177,183,189,192,195,198,201,207,213,217,220,242],[10,11,5],"h1",{"id":12},"ai-서비스로컬",[14,15,16],"p",{},"Doco Translate는 번역을 위해 Ollama, LM Studio 및 oMLX와 같은 로컬 AI 모델 런타임에 연결할 수 있습니다.",[14,18,19],{},[20,21],"img",{"alt":22,"src":23},"로컬 AI 번역 서비스","/images/docs/local-ai-services.webp",[25,26,28],"h2",{"id":27},"현지-모델의-장점","현지 모델의 장점",[14,30,31],{},"로컬 모델을 사용하는 것은 몇 가지 중요한 이점을 제공하기 때문에 Doco Translate가 가장 강력하게 권장하는 접근 방식입니다.",[33,34,36],"h4",{"id":35},"번역-품질","번역 품질",[14,38,39],{},"대형 언어 모델은 자연어 작업, 특히 번역에 탁월합니다. 일반적으로 기존 기계 번역 엔진보다 더 나은 번역 품질을 제공합니다.",[33,41,43],{"id":42},"개인정보-보호로컬-런타임을-통해-로드된","개인정보 보호로컬 런타임을 통해 로드된",[14,45,46],{},"Model은 데이터를 장치에 유지합니다. 문서 처리가 비공개로 유지되도록 아무 것도 제3자 제공업체로 전송되지 않습니다.",[33,48,49],{"id":49},"비용",[14,51,52],{},"클라우드 AI API와 달리 로컬 모델은 토큰 비용을 청구하지 않으며 추가 사용 요금도 없습니다.",[25,54,56],{"id":55},"로컬-모델의-한계","로컬 모델의 한계",[33,58,60],{"id":59},"모델-사이즈","모델 사이즈",[14,62,63],{},"Local 모델은 일반적으로 오픈 소스이며 소비자 하드웨어에서 잘 실행되는 모델은 4B, 9B, 35B-A3B 또는 27B와 같이 상대적으로 작은 매개변수 개수를 갖는 경우가 많습니다. 따라서 일반적인 기능은 대규모 클라우드 모델보다 약할 수 있습니다.",[14,65,66],{},"그러나 번역에는 매우 긴 추론 체인이나 가장 강력한 추론 모델이 필요하지 않습니다. 더 작은 로컬 모델은 좋은 번역을 생성할 수 있으므로 매우 비용 효과적인 선택이 됩니다.",[33,68,70],{"id":69},"추론-속도","추론 속도",[14,72,73],{},"로컬 추론 속도는 하드웨어와 모델 크기에 따라 다릅니다. 더 나은 하드웨어와 더 작은 모델은 더 빠르지만 로컬 추론은 일반적으로 클라우드 AI API보다 여전히 느립니다.",[25,75,77],{"id":76},"로컬-ai-모델-런타임","로컬 AI 모델 런타임",[79,80,81,94],"table",{},[82,83,84],"thead",{},[85,86,87,91],"tr",{},[88,89,90],"th",{},"도구",[88,92,93],{},"특성",[95,96,97,112,124],"tbody",{},[85,98,99,109],{},[100,101,102],"td",{},[103,104,108],"a",{"href":105,"rel":106},"https://ollama.com/",[107],"nofollow","올라마",[100,110,111],{},"간단한 명령줄 설정 및 모델 관리",[85,113,114,121],{},[100,115,116],{},[103,117,120],{"href":118,"rel":119},"https://lmstudio.ai/",[107],"LM 스튜디오",[100,122,123],{},"로컬 모델을 다운로드하고 실행할 수 있는 친숙한 그래픽 인터페이스",[85,125,126,133],{},[100,127,128],{},[103,129,132],{"href":130,"rel":131},"https://omlx.ai/",[107],"oMLX",[100,134,135],{},"Apple Silicon에 최적화된 고속 로컬 LLM 추론",[25,137,108],{"id":108},[14,139,140],{},"Ollama는 로컬 모델을 실행하기 위한 접근 가능한 명령줄 도구입니다.",[14,142,143,144,148],{},"공식 지침에 따라 Ollama를 설치한 후 다음을 실행하세요. ",[145,146,147],"code",{},"ollama pull MODEL_NAME"," 모델을 다운로드합니다.",[14,150,151],{},"모델을 다운로드하고 Ollama에서 성공적으로 실행한 후 한 번의 클릭으로 Doco Translate에 연결합니다.",[14,153,154,155,158],{},"기본 Ollama 엔드포인트는 다음과 같습니다. ",[145,156,157],{},"http://localhost:11434",".",[14,160,161],{},[20,162],{"alt":163,"src":164},"Ollama 서비스 설정","/images/docs/ollama-settings.webp",[25,166,120],{"id":167},"lm-스튜디오",[14,169,170],{},"LM Studio는 로컬 모델 실행을 위한 그래픽 인터페이스를 제공하며 시작하기 쉽습니다.",[14,172,173],{},"공식 웹사이트에서 LM Studio를 설치한 후 앱 내에서 모델을 다운로드하세요.",[14,175,176],{},"모델을 다운로드한 후 LM Studio의 로컬 모델 서버를 시작하여 API를 노출합니다. 그런 다음 한 번의 클릭으로 Doco Translate에 연결할 수 있습니다.",[14,178,179,180,158],{},"기본 LM Studio 엔드포인트는 다음과 같습니다. ",[145,181,182],{},"http://localhost:1234",[14,184,185],{},[20,186],{"alt":187,"src":188},"LM 스튜디오 서비스 설정","/images/docs/lm-studio-settings.webp",[25,190,132],{"id":191},"omlx",[14,193,194],{},"oMLX는 Apple Silicon에 최적화된 로컬 모델 런타임이며 매우 빠른 추론을 제공합니다.",[14,196,197],{},"공식 웹사이트에서 oMLX를 설치하고 oMLX 콘솔을 열고 모델을 다운로드하세요.",[14,199,200],{},"oMLX는 로컬 서비스를 자동으로 시작합니다. 모델을 다운로드하고 테스트를 통과한 후 한 번의 클릭으로 Doco Translate에 연결합니다.",[14,202,203,204,158],{},"기본 oMLX 엔드포인트는 다음과 같습니다. ",[145,205,206],{},"http://localhost:8000",[14,208,209],{},[20,210],{"alt":211,"src":212},"oMLX 서비스 설정","/images/docs/omlx-settings.webp",[25,214,216],{"id":215},"추천-모델","추천 모델",[14,218,219],{},"Doco Translate는 번역을 위해 다음 모델을 권장합니다.",[221,222,223,227,230,233,236,239],"ul",{},[224,225,226],"li",{},"Hy-MT2-1.8B: 매우 빠르고 메모리 사용량이 최소화되며 번역에 특별히 최적화되었습니다.",[224,228,229],{},"Qwen3.5:9B: 상대적으로 메모리 사용량이 적고 빠릅니다.",[224,231,232],{},"Qwen3.6:35B-A3B: 강력한 기능과 빠른 성능, 더 높은 메모리 사용",[224,234,235],{},"Gemma4:12B: 품질, 속도, 메모리 사용의 균형 잡힌 선택",[224,237,238],{},"Qwen3.6:27B: 가장 강력한 기능을 제공하지만 느리고 메모리 집약적입니다.",[224,240,241],{},"Qwen3.5:4B: 메모리 사용량이 적어 빠르지만 안정성이 약간 떨어집니다.",[14,243,244,245,248,249,252,253,256],{},"대부분의 워크로드에는 다음을 사용하세요. ",[145,246,247],{},"Hy-MT2-1.8B"," 또는 ",[145,250,251],{},"Qwen3.5:9B"," 가 기본 모델입니다. 둘 다 빠르고 메모리 효율적입니다. 더 높은 품질과 안정성을 위해 다음을 사용하세요. ",[145,254,255],{},"Qwen3.6:35B-A3B","는 더 많은 기능을 제공하지만 더 많은 메모리를 소비합니다.",{"title":258,"searchDepth":259,"depth":259,"links":260},"",2,[261,262,263,264,265,266,267],{"id":27,"depth":259,"text":28},{"id":55,"depth":259,"text":56},{"id":76,"depth":259,"text":77},{"id":108,"depth":259,"text":108},{"id":167,"depth":259,"text":120},{"id":191,"depth":259,"text":132},{"id":215,"depth":259,"text":216},"Ollama, LM Studio 또는 oMLX를 연결하고 장치에서 실행되는 AI 모델로 번역하세요.","md",{},true,"/ko/docs/service/ai/local",{"title":5,"description":268},"ko/docs/service/ai/local","6NWlXoS5TM-5ZpGBezYhd57YBPNCwMJv4E02bVCEz6Y",1787207636373]