쓸모 쓸모연구소 · 실전 노트
제 217 호이번 주 새 글 91 편2026 · 09 · 28
AI 업무 자동화
맥미니 · MLX · Claude

이 글에는 쿠팡 파트너스 링크가 있으며, 구매 시 일정액의 수수료를 받습니다.

맥미니 16GB 로컬 AI 사용법, 목소리 복제와 음악 생성까지

맥미니 16GB 로컬 AI로 이미지 생성, 글 읽어주는 음성(TTS), 목소리 복제, 음악 생성, 코딩 도구 연동까지 어디까지 되는지 42단계로 정리했습니다. 램 16GB·저장 256GB짜리 맥미니 M4 기본형에서 무료 오픈소스 맥 앱 하나로 직접 돌려 본 결과이고, 작업별로 램이 얼마나 필요한지와 음악 생성에서 결과를 가르는 가사 형식도 함께 담았습니다.

맥미니 16GB 로컬 AI 사용법, 목소리 복제와 음악 생성까지 삽화
삽화 · 쓸모연구소

맥미니 로컬 AI 체험에서 확인한 것

방구석 리뷰룸(채널 BGS REVIEW)이 게스트 두 명과 함께 무료 오픈소스 맥 앱 MLX Serve를 써 본 체험 영상입니다. 검증 대상은 램 16GB·저장 256GB짜리 맥미니 M4 기본형, 이른바 "깡통"입니다. 로컬 AI란 인터넷 너머 회사 서버가 아니라 내 컴퓨터 안에서 AI 모델을 직접 돌리는 방식을 말합니다. 구독료가 없고 자료가 밖으로 나가지 않는 대신, 내 컴퓨터의 램과 저장 공간이 한계를 정합니다.

화자가 소개한 앱의 조건은 이렇습니다. 무료 오픈소스, 완전히 오프라인 동작, macOS 26 이상, M1부터 M5까지 지원하고 앞으로 나올 M6도 된다. 여기까지는 화자의 설명입니다.

출연자들의 결론부터 옮기면 이렇습니다. 채팅용 로컬 AI는 메리트가 떨어진다. "그럴 거면 ChatGPT 쓴다." 대신 창작 쪽, 그러니까 이미지·음성·음악이 볼 만하다는 것입니다.

가장 놀란 지점은 음악이었습니다. "이미지는 GPT 시키면 금방 나오는데 음악 만드는 건 체험해 볼 일이 별로 없었다"며, 16GB 맥미니 기본형에서 딸깍 한 번으로 곡이 나오는 걸 "충격적"이라고 표현합니다.

출연자와 테스트 기기

  • 진행: 방구석 리뷰룸
  • 게스트: TNT랩스 고재현 대표
  • 게스트: 양시준. 성남 판교에서 소프트웨어 개발

기기는 세 대를 썼습니다.

  • 맥미니 M4 기본형: 램 16GB / 저장 256GB. 이 영상의 주 검증 대상입니다
  • 맥미니 M4 Pro: 램 48GB / 1TB. 게스트의 메인 개발 업무용입니다
  • 맥북 M3 Max: 램 36GB. 화자가 쓰는 기기입니다

앱이 램 용량별로 쓸 수 있는 모델을 추천해 준다고 화자는 말합니다. 다만 시스템과 다른 프로그램이 램을 쓰고 있어서 48GB를 전부 AI에 쓰지는 못한다는 점도 짚습니다.

준비물과 로컬 AI 작업별 필요 램

  • 애플 실리콘 맥 1대. M1~M5
  • macOS 26 이상. 사과 메뉴 → "이 Mac에 관하여"에서 버전을 확인할 수 있습니다
  • 저장 공간 여유. 모델 파일이 큽니다. 영상 모델은 다운로드만 70GB입니다
  • 비용: 무료
  • 인터넷은 모델 다운로드 때 필요합니다. 그다음은 "완전히 오프라인"이라는 것이 화자의 설명입니다
  • (선택) 클로드 코드 또는 코덱스. 8장 연동에 필요합니다. 둘 다 AI에게 코딩을 시키는 도구입니다

작업별 필요 램은 화자가 앱 화면에 뜬 값을 읽은 것입니다.

  • TTS·목소리 복제, 가장 큰 모델: 약 8GB
  • 음악 생성, 기본 모델: 약 9GB
  • 이미지 생성, 작은 모델: 16GB에서 동작 확인
  • 음악 생성, 다른 모델: 약 20GB
  • 이미지 생성, 대형 모델: 약 24GB
  • 영상 생성, 미니맥스 저사양 모델: 최소 26GB
  • 영상 생성, 미니맥스 상위 모델: 44GB + 다운로드 70GB

영상 생성은 출연자 기기로 아예 못 돌렸습니다. "제 걸로 안 됩니다"라며, 차세대 맥이 나오면 영상 AI만 따로 다루겠다고 예고합니다.

한 가지 더. 이 영상은 튜토리얼이 아니라 리뷰입니다. 화면에서 뭘 눌렀는지 말로 다 설명하지 않기 때문에, 아래 42단계는 영상에서 실제로 언급된 동작을 중심으로 모았고, 빈 곳은 맥 앱의 일반적인 사용법으로 채웠습니다.

1장. MLX Serve 앱 설치 (1~5단계)

1. 앱 다운로드 페이지에 들어갑니다. 영상에는 주소가 나오지 않고 "다운로드 가시면 너무나 쉽게 받을 수가 있고요"라는 말뿐입니다. 공식 사이트 mlxserve.com이나 깃허브에서 "mlx-serve"를 검색하면 됩니다.

확인: 다운로드 버튼이 있는 페이지가 열렸다.

2. 앱 파일을 내려받습니다.

확인: 다운로드 폴더에 파일이 생긴다.

3. 내려받은 파일을 더블클릭해 엽니다.

확인: 설치 창이 뜬다. 맥 dmg 파일의 일반적인 형태입니다.

4. 앱 아이콘을 같은 창 안의 Applications(응용 프로그램) 폴더 아이콘 위로 끌어다 놓습니다. 게스트 말로는 "일반 프로그램 설치하듯이 설치하고 다운로드하면 바로 사용할 수 있었다"고 합니다.

확인: 복사가 끝나고 응용 프로그램 폴더에 앱이 생긴다.

5. 응용 프로그램 폴더에서 앱을 실행합니다. "확인되지 않은 개발자" 경고가 뜨면 시스템 설정 → 개인정보 보호 및 보안 아래쪽의 "그래도 열기"를 누릅니다.

확인: 앱이 로컬 서버를 구동한 상태가 화면에 표시된다.

참고: 이 로컬 서버가 떠 있어야 8장의 클로드 코드·코덱스 연동이 됩니다. 로컬 서버는 내 맥 안에서만 AI 기능을 내어 주는 작은 창구라고 보면 됩니다.

2장. 내 맥 사양에 맞는 모델 고르기 (6~9단계)

6. 앱의 모델스(Models) 항목을 엽니다.

확인: 여러 모델이 목록으로 보인다.

7. 각 모델 옆에 표시된 필요 램 안내를 읽습니다. 화자는 앱이 램별 모델 추천을 아예 해 준다고 말합니다.

확인: 내 램으로 되는 모델과 "램 부족"으로 뜨는 모델이 구분돼 보인다.

8. 내 램으로 가능하다고 표시된 모델 중 하나를 고릅니다.

주의: 시스템과 다른 프로그램도 램을 쓰므로 물리 램 전부를 AI에 쓸 수는 없습니다.

확인: "램 부족" 경고가 없는 모델을 선택했다.

9. 그 모델을 다운로드합니다. 영상에서 버튼 위치를 말하지 않는데, 보통 모델 이름 옆의 다운로드 아이콘이나 "Download" 버튼입니다.

확인: 모델이 내려받아지고 사용 가능 상태가 된다.

참고로 텍스트 채팅 모델은 16GB 기기에서 젬마(Gemma) 계열 기준 목록 위에서 3개까지만 되고, 그 아래부터는 램 부족 경고가 뜹니다. 48GB M4 Pro에서는 앱이 "여기서 제일 강력한 모델 중 하나"라고 안내하며 큰 모델을 추천했다고 합니다. 다만 출연자들은 채팅만 하려고 로컬 AI를 쓸 사람은 거의 없을 거라고 봤습니다.

3장. 로컬 AI로 이미지 만들기 (10~16단계)

10. 이미지 생성 모델을 고릅니다. 16GB 기기라면 작은 모델, 36GB 이상이라면 큰 사이즈 모델이 기준입니다.

확인: 이미지 모델이 선택돼 있다.

11. 해상도를 1024 × 1024로 설정합니다. 화자는 "퀄리티로 놓고 기본 1024 1024로 해 놓고" 생성했습니다.

확인: 해상도 값이 1024×1024다.

12. 프롬프트(만들 그림을 설명하는 문장)를 입력합니다. 화자가 쓴 예시는 "나이가 있는 어부의 얼굴 초상화"였습니다. 이미지 모델은 영어 프롬프트를 더 잘 알아듣는 경우가 많으니, 결과가 어긋나면 영어로도 넣어 봅니다.

프롬프트
portrait of an elderly fisherman's face, weathered skin, detailed wrinkles, natural light

확인: 입력란에 프롬프트가 들어 있다.

13. 생성(Generate)을 누릅니다.

주의: 화자는 "시간이 꽤 걸렸고 배터리가 꽤 녹았다"고 말합니다. 노트북이면 전원을 꽂아 두는 게 낫습니다.

확인: 생성이 시작되고 잠시 뒤 이미지가 나온다.

14. 결과 이미지를 확인합니다.

확인: 프롬프트대로 된 이미지가 나왔다. 화자 평은 "와, 결과물은 대박이네", "맥북에서 써먹을 수 있는 진짜 퀄리티", "프롬프트를 되게 충실하게 잘 따르네요"였습니다.

(선택) 빠른 생성 모드 비교

15. 패스트(Fast) 모드로 바꿉니다. 생성 설정 쪽의 품질 옵션에서 고르는 형태입니다.

확인: Fast 모드가 켜졌다.

16. 같은 프롬프트로 다시 생성합니다.

확인: 훨씬 빨리 이미지가 나온다.

여기서 기기별로 평가가 갈립니다. 36GB 맥북 + 큰 모델에서는 Fast도 "그냥 봤을 때 전혀 흠이 없는 수준"이고, 다만 주름과 피부 텍스처 디테일은 기본 모드가 낫습니다. 반면 16GB 맥미니 + 작은 모델에서는 기본 모드 결과도 "생각보다 괜찮은데? 경량 모델인데도" 소리가 나왔지만, Fast를 걸면 퀄리티 차이가 확 납니다. 화자 표현으로 "2~3년 전 AI 이미지 막 나왔을 때 정도 느낌"입니다.

4장. 글자를 읽어주는 음성(TTS) 만들기 (17~21단계)

TTS는 글자를 넣으면 사람 목소리로 읽어 주는 기술입니다. 오디오·음악 쪽은 목록의 다섯 개 모델을 16GB 맥미니 M4에서 전부 쓸 수 있었습니다.

17. 오디오(TTS) 탭으로 이동합니다. 탭 이름은 영상에 나오지 않지만 Speech, Audio처럼 음성을 뜻하는 이름입니다.

확인: TTS 관련 화면이 열렸다.

18. 앱이 추천하는 모델 중 제일 큰 모델을 고릅니다. 화자가 이렇게 했고, 이 모델도 램 8GB 정도면 된다고 말합니다.

확인: 모델이 선택됐고 램 경고가 없다.

19. 읽게 할 문장을 입력합니다. 화자가 쓴 문장은 "여러분 안녕하세요. 방구석 리뷰룸의 시간입니다."였습니다.

확인: 입력란에 문장이 들어 있다.

20. 레퍼런스(참고 음성) 없이 생성합니다.

확인: 화자 표현으로 "거의 바로" 음성 파일이 생성된다.

21. 생성된 음성을 재생해 확인합니다.

확인: 입력한 문장이 소리로 나온다. M4 맥미니에서도 "크게 시간이 걸리지 않네요"가 화자 평입니다.

5장. 맥미니 로컬 AI로 내 목소리 복제하기 (22~26단계)

목소리 복제(보이스 클로닝)는 짧은 내 목소리 샘플을 주면 그 톤으로 다른 문장을 읽게 하는 기능입니다.

22. 내 목소리 레퍼런스를 준비합니다. 화자는 그 자리에서 짧게 녹음해 넣었습니다. 게스트도 "안녕하세요. 양시준입니다. 저는 성남 판교에서 소프트웨어 개발하고 있습니다"라고 녹음해 샘플로 줬습니다. 맥 기본 앱 "음성 메모"로 녹음하면 파일로 꺼내기 쉽습니다.

주의: 필요한 레퍼런스 길이는 영상에 없습니다. "짧은 레퍼런스에서 목소리를 복제할 수 있다"는 말뿐이라, 위 게스트 예시처럼 한두 문장 분량을 조용한 곳에서 또렷하게 녹음하는 것이 무난합니다.

확인: 짧은 음성 파일이나 녹음이 준비됐다.

23. 그 레퍼런스를 앱에 넣습니다. 업로드 버튼 위치와 파일 형식은 영상에 없습니다. 레퍼런스 칸에 파일을 끌어다 놓거나 파일 선택 버튼으로 고르는 방식이 일반적입니다.

확인: 레퍼런스가 등록됐다.

24. 읽게 할 문장을 입력합니다.

확인: 문장이 입력됐다.

25. 제너레이트(Generate)를 누릅니다.

주의: 레퍼런스를 주고 클로닝하는 쪽이 일반 TTS보다 "확실히 좀 더 걸린다"고 합니다.

확인: 복제된 목소리로 문장이 읽힌다.

26. 결과를 듣고 원본과 비교합니다.

확인: 화자 평은 "디테일은 다른데 목소리 톤은 생각보다 비슷하다", "제가 조금 경박하게 할 때랑 되게 비슷해요"였습니다. 다른 사람 샘플로는 "이건 좀 다른데, 제3의 목소리로" 나오기도 했습니다.

종합하면 이렇습니다. "그냥 TTS 바로 생성시키는 건 M4 맥미니도 경쾌하게 가능하고, 내 목소리 클로닝은 시간이 조금 더 걸렸다. 근데 해볼 만하다." 화자는 출장 등으로 직접 나레이션 녹음이 애매할 때 쓸 수 있겠다고 봅니다. 다른 사람 목소리를 본인 동의 없이 복제해 쓰는 것은 피해야 합니다.

6장. 로컬 AI로 음악 만들기 (27~36단계)

이 영상의 하이라이트입니다.

27. 뮤직(Music) 탭으로 이동합니다.

확인: 음악 생성 화면이 열렸다.

28. 모델의 필요 램을 확인합니다.

확인: 기본 모델은 약 9GB, 다른 모델은 약 20GB로 표시된다.

29. 내 램으로 되는 모델을 고릅니다.

확인: 램 경고 없이 선택됐다.

30. 장르를 정합니다. 화자는 R&B로 시작했습니다.

확인: 장르가 지정됐다.

31. 가사를 섹션 태그를 쓴 형식으로 작성합니다.

주의: 이 단계가 결과를 가릅니다. 화자가 형식 없이 가사만 넣었더니 가사를 무시하고 허밍처럼 흘려 부르는 곡이 나왔습니다. 마지막의 "팔로우"만 겨우 가사로 들렸습니다. 그 뒤 "태그를 써서 가사를 작성하면 섹션에 딱 맞게 나오는 것 같다"고 말합니다.

가장 쉬운 길은 앱이 제공하는 예시문을 그대로 쓰는 것입니다. 화자도 예시를 써서 성공했습니다. 섹션 태그는 대괄호로 "여기부터 1절", "여기부터 후렴"을 표시하는 방식이 흔합니다. 아래 틀에 가사만 바꿔 넣고, 앱 예시와 표기가 다르면 앱 쪽을 따릅니다.

프롬프트
[verse]
창밖에 비가 내리는 오후
식은 커피 한 잔을 앞에 두고

[chorus]
오늘은 천천히 걸어가도 돼
너의 속도로 괜찮아

[bridge]
멈춰 선 것 같아도
우린 가고 있는 중이야

확인: 가사 입력란에 섹션 태그가 붙은 가사가 들어 있다.

32. 생성을 누릅니다.

확인: 잠시 뒤 곡이 만들어진다.

33. 결과를 재생해 듣습니다.

확인: 가사가 섹션에 맞게 불린 곡이 나온다. 화자 평은 "노래가 나쁘지 않은데", "딱 카페 가면 나올 것 같은", "와 대박이다"였습니다.

참고: "음(질)은 약간 열화돼 있다고 느껴진다"는 단서도 붙습니다. 그러면서도 이게 맥미니 기본 모델에서 딸깍으로 나온 결과라는 점을 강조합니다.

(선택) 더 좋은 결과를 원하면

34. 모델을 미니맥스 뮤직 3(MiniMax Music 3)으로 바꿉니다.

확인: 모델이 미니맥스 뮤직 3으로 선택됐다.

35. 가사를 더 길게 써서 다시 생성합니다. 게스트는 자기소개형 가사를 넣었습니다. "내 이름은 고재킹… 매일 하루에 한 개씩 프로그램을 만들어요…" 그다음 가사를 더 붙여 재생성했습니다.

확인: 곡이 나온다. 반응은 "우와", "미쳤다. 더 듣고 싶다", "오늘 해본 것 중에 가장 충격적이에요"였습니다. 게스트는 "저는 이제 하루에 한 개씩 곡을 만들겠습니다"라고 말합니다.

36. (선택) 이미 갖고 있는 노래로 다른 버전을 만듭니다. 화자는 트로트·힙합 버전 리메이크 유행을 예로 들며 그런 기능도 있다고 말합니다.

주의: 이 기능의 구체적 사용 절차는 시연하지 않았습니다. 뮤직 탭에서 원곡 파일을 넣는 칸(참고 오디오, 리믹스 같은 이름)이 있는지 찾아보고, 장르를 바꿔 생성해 보는 순서입니다. 남의 곡을 바탕으로 만든 결과물은 저작권 문제가 생길 수 있으니 개인 감상용으로 둡니다.

확인: 원곡의 다른 버전이 생성된다.

7장. 상업 이용 가능 여부 확인 (37단계)

37. 쓰려는 모델의 라이선스(사용 허락 조건)를 조사합니다. 모델 목록에서 모델 이름을 눌러 배포 페이지로 가면 라이선스 항목이 있습니다.

확인: 에이스 스텝(ACE-Step) 모델은 화자가 조사해 보니 생성물 상업 이용 가능이 명시돼 있었다고 합니다.

주의: 미니맥스 뮤직 3을 비롯한 다른 모델의 라이선스 조건은 영상에서 다루지 않았습니다. 상업적으로 쓸 거라면 모델별로 따로 확인해야 합니다.

8장. 클로드 코드·코덱스와 로컬 AI 연동 (38~42단계)

구조는 이렇습니다. 맥 앱(GUI)뿐 아니라 CLI 프로그램(글자 명령으로 쓰는 버전)도 같이 제공하기 때문에, 클로드 코드 같은 AI에게 "이거 해 줘"라고 시키면 AI가 알아서 이 앱을 씁니다.

8-1. 앱 안에서 코딩 도구 띄우기

38. 앱의 코드(Code) 기능으로 들어갑니다.

확인: 클로드 코드·코덱스 같은 항목이 보인다.

39. 클로드 코드(Claude Code)를 누릅니다. 컴퓨터에 코덱스(Codex)가 깔려 있으면 앱이 그것도 인식합니다.

확인: 워크스페이스가 지정되고, 모델이 앱이 추천하는 로컬 모델로 뜬 상태의 클로드 코드가 열린다.

40. 로컬 모델로 작업을 시킵니다. 게스트는 아래처럼 지시했고, 웹에서 로컬호스트(내 컴퓨터 안의 웹 주소)로 실행되는 점프 게임이 나왔습니다.

프롬프트
간단한 게임 만들어서 실행해 봐라.

확인: 결과물이 나온다. 눈 깜빡이는 캐릭터, 부드러운 움직임, 점프할 때 터지는 효과, 거리에 따라 속도가 다른 구름, 더블 점프까지 구현됐습니다. 게스트 평은 "3년 전에 바이브 코딩하는 느낌이긴 했어요"였고, 그래도 "모델이 어느 정도 똑똑해야 저런 걸 생각해 줄 수 있다"고 덧붙입니다.

8-2. 외부 AI가 로컬 서버를 쓰게 하기

41. 클로드 코드나 코덱스에게 이 앱을 써서 결과물을 만들라고 평이한 말로 지시합니다. 게스트가 실제로 준 지시는 이렇습니다.

프롬프트
여기에 있는 음악을 MLX Serve로 만들어라.
게임 시작 화면에서의 음악도 만들어서 넣어 줘.

화자가 코덱스에 준 지시는 이렇습니다.

프롬프트
게임에 어울릴 리소스 만들어 주고 브금도 한번 생성해 줘.

주의: 1장에서 앱을 실행해 로컬 서버가 떠 있는 상태여야 합니다. 순서 고정입니다. 실행 중인 로컬 서버를 AI가 알아서 잡아주므로 그냥 요청하면 된다고 화자는 말합니다.

확인: AI가 로컬 서버를 호출해 음악·리소스를 만들어 넣는다. 결과물은 마법사 등 캐릭터 구성과 판타지 게임 BGM이었습니다. "모든 음악은 다 로컬에서 만들었어요."

역할 분담은 이렇게 정리됩니다. 코드 구현은 클로드 코드가, 음악 생성 부분만 이 앱이 맡습니다. 다만 "폴짝폴짝" 같은 시키지도 않은 동작이 들어갔다며, 현업용이라면 훨씬 더 디테일하게 명령을 줘야 한다는 단서가 붙습니다. 예를 들면 이렇게 범위를 좁혀 줍니다.

프롬프트
게임 코드는 건드리지 말고, 시작 화면용 BGM 한 곡만 MLX Serve로 만들어서 assets/music 폴더에 넣어 줘.
분위기는 잔잔한 판타지, 길이는 1분 안쪽으로.

8-3. (선택) 반복 작업 예약

42. 태스크 반복 작업에 명령을 등록합니다. 화자는 "매일 9시에 이렇게 실행하게 하는 것"이 가능하다고 말합니다.

주의: 등록 화면 위치와 구체적 설정 방법은 영상에 없습니다. 앱의 작업(Task) 또는 예약 메뉴에서 실행할 명령과 시각을 정하는 방식일 가능성이 큽니다. 메뉴가 안 보이면 클로드 코드에게 "매일 오전 9시에 이 작업을 실행하도록 예약해 줘"라고 시켜 설정을 맡기는 방법도 있습니다.

확인: 지정한 시각에 작업이 자동 실행된다.

맥미니 로컬 AI 최종 체크리스트

  • macOS 26 이상, 애플 실리콘(M1~M5) 맥이다
  • 앱을 응용 프로그램 폴더로 끌어다 놓아 설치했다
  • 앱을 실행해 로컬 서버가 구동 중이다
  • 모델스 목록에서 내 램에 "가능"으로 뜨는 모델만 골랐다
  • (이미지) 1024×1024로 생성해 결과를 확인했다
  • (TTS) 레퍼런스 없이 한 번 생성해 소리가 나오는 걸 확인했다
  • (목소리 복제) 짧은 레퍼런스를 넣고 생성해 톤을 비교했다
  • (음악) 가사에 섹션 태그를 붙여서 생성했다. 안 붙이면 가사를 무시한다
  • 쓰려는 모델의 상업 이용 가능 여부를 확인했다
  • (연동) 앱이 켜진 상태에서 클로드 코드·코덱스에 지시해 로컬 서버가 잡히는 걸 확인했다

로컬 AI 쓰다가 자주 막히는 곳

  • 모델 목록에 "램 부족"이 뜬다: 내 맥 램보다 모델 요구량이 큽니다. 경고가 없는 위쪽 모델을 고릅니다. 16GB라면 젬마 계열은 위에서 3개까지입니다.
  • 램은 충분한데 느리거나 실패한다: 시스템과 다른 프로그램이 램을 쓰고 있어 물리 램 전부를 AI에 못 씁니다. 브라우저 탭 등 다른 프로그램을 닫고 다시 시도합니다.
  • 음악을 만들었는데 가사를 무시하고 허밍만 한다: 형식에 맞춰 요청하지 않았습니다. 가사를 섹션 태그를 써서 작성합니다. 앱의 예시 형식을 그대로 쓰면 섹션에 맞게 나옵니다.
  • 이미지 생성 중 노트북 배터리가 급격히 준다: 큰 모델에 1024×1024 생성은 부하가 큽니다. 전원을 연결하고, 급하면 Fast 모드를 씁니다.
  • Fast 모드 결과가 너무 조악하다: 작은 모델과 Fast 조합이라 그렇습니다. 기본(퀄리티) 모드로 돌리거나 램이 되는 기기에서 큰 모델을 씁니다.
  • 영상 생성 모델이 안 돌아간다: 저사양 모델도 최소 26GB, 상위 모델은 44GB에 다운로드만 70GB입니다. 현재 기기로는 불가하고, 화자도 "제 걸로 안 됩니다"라고 말합니다.
  • 클로드 코드·코덱스가 로컬 서버를 못 찾는다: 앱이 실행 중이 아닙니다. 앱을 먼저 띄워 둡니다.
  • AI가 시키지 않은 동작을 넣는다: 지시가 뭉뚱그려져 있습니다. 현업용이라면 훨씬 더 디테일하게 명령을 줘야 합니다.
  • 채팅 용도로 써 보니 별로다: 채팅은 로컬 AI의 메리트가 떨어진다는 것이 출연자들 평가입니다. 이미지·음성·음악 같은 창작 용도로 씁니다.

앱과 모델 파일 지우는 법

응용 프로그램 폴더로 끌어다 놓는 방식으로 설치했으니, 응용 프로그램 폴더에서 앱을 휴지통으로 옮기면 지워집니다. 맥의 일반적인 드래그 설치 앱 규칙입니다.

다만 내려받은 모델 파일이 어디에 저장되고 어떻게 지우는지는 영상에서 다루지 않았습니다. 영상 모델만 70GB이니, 용량을 되찾으려면 모델 파일을 따로 지워야 합니다. 앱을 지우기 전에 모델스 목록에서 모델별 삭제 기능이 있는지 먼저 봅니다. 그다음 시스템 설정 → 일반 → 저장 공간에서 어느 폴더가 큰지 확인하고, Finder에서 홈 폴더의 숨김 폴더(Command + Shift + 마침표로 보이게 함) 중 모델이 쌓인 곳을 찾습니다. 로컬 AI 앱은 흔히 홈 폴더의 .cache 아래에 모델을 받습니다.

16GB 맥미니로 할 만한 일과 아닌 일

세 줄로 줄이면 이렇습니다. 채팅은 굳이 로컬로 할 이유가 없다. 이미지는 16GB에서도 쓸 만하고, TTS와 목소리 복제는 8GB면 돈다. 음악은 9GB짜리 기본 모델로도 곡이 나온다.

실전 팁 하나만 다시 꼽자면 31단계입니다. 가사에 섹션 태그를 안 붙이면 모델이 가사를 흘려 버리고 허밍만 합니다. 같은 모델, 같은 기기인데 태그 하나로 결과가 갈렸습니다.

출연자들의 마무리는 이랬습니다. "컨텐츠용 음악 만들 때는 진짜 유용하게 쓰겠다", "인디 게임 개발자분들한테 희망이 보이지 않나?" 그리고 자기 사양에서 할 수 있는 일이 있으니 한번 시험해 보라는 권유. 다음 편은 새 맥이 나오면, 영상 AI는 차세대 맥으로 다루겠다고 예고했습니다.

자주 묻는 질문

맥미니 16GB로 로컬 AI 음악 생성이 되나요?

됩니다. 영상에서 음악 기본 모델은 약 9GB 램을 요구했고, 16GB 맥미니 M4 기본형에서 곡이 만들어졌습니다. 다만 가사에 섹션 태그를 붙이지 않으면 가사를 무시하고 허밍만 하는 곡이 나왔습니다.

로컬 AI 목소리 복제에는 램이 얼마나 필요한가요?

영상에서 쓴 가장 큰 TTS 모델이 약 8GB였고, 이 모델로 목소리 복제까지 했습니다. 일반 TTS보다 복제가 시간이 조금 더 걸렸다는 평입니다.

맥미니 16GB로 AI 영상 생성도 할 수 있나요?

이 영상 기준으로는 어렵습니다. 저사양 영상 모델도 최소 26GB, 상위 모델은 44GB에 다운로드만 70GB라 출연자 기기에서도 돌리지 못했습니다.

로컬 AI로 만든 음악을 상업적으로 써도 되나요?

모델마다 다릅니다. 화자가 조사한 ACE-Step 모델은 생성물 상업 이용이 가능하다고 명시돼 있었지만, 미니맥스 뮤직 3 등 다른 모델은 영상에서 확인하지 않았습니다. 쓰려는 모델의 라이선스를 직접 확인해야 합니다.

로컬 AI를 채팅용으로 쓰는 건 어떤가요?

출연자들은 메리트가 떨어진다고 봤습니다. 16GB에서는 채팅 모델 선택지도 적어서 "그럴 거면 ChatGPT 쓴다"는 평이었고, 이미지·음성·음악 같은 창작 용도를 권했습니다.

이 글은 영상의 자동 자막을 근거로 정리했고 화면은 대조하지 못했습니다. 앱 이름은 자막에 "MLX 서브"(한 번은 "MX 서브")로 찍혀 있어 같은 기능을 내세우는 오픈소스 앱 MLX Serve(mlx-serve)로 옮겼고, 채널명은 자막에 "황구석 리브룸"으로 오인식된 대목이 있습니다. 앱 설치 경고 처리, 가사 태그 예시, 모델 파일 삭제 위치는 영상에 없는 부분이라 편집자가 일반적인 방법으로 보탰습니다. 영상 길이는 16분 38초입니다.

출처: youtu.be/…

원본 영상 보러가기 ↗