omm run
omm으로 설치한 모델과 대화를 시작합니다 — Ollama는 이 터미널에서 바로 대화하고, KoboldCpp·text-generation-webui는 모델을 로드한 채로 시작하며, GUI 앱은 그냥 열립니다.
01 / 06
개요
install이 끝난 다음 쓰는 명령입니다. 이름을 생략하면 설치된 것 중에서 대화형으로 고르고, 이름을 주면 그 모델이 어떤 러너에 연결돼 있는지 파악해서 터미널 대화로 바로 들어가거나(Ollama), 모델을 로드한 채로 실행하거나(KoboldCpp, text-generation-webui), GUI 앱을 열어 그 앱의 로컬 모델 목록에서 고르게 합니다. 한 모델이 여러 러너에 연결돼 있으면 --engine으로 자동 선택을 바꿀 수 있습니다.
02 / 06
옵션
이 명령이 받는 모든 옵션과, 생략했을 때의 기본값입니다.
[name]—기본값: picks interactively설치된 모델의 파일명(omm list 참고). 생략하면 설치된 것 중에서 대화형으로 고릅니다.
--engineNAME기본값: auto-picks a linked engine연결된 러너 중 어느 것을 쓸지: ollama, lmstudio, jan, koboldcpp, textgenwebui, anythingllm, mstystudio. 생략하면 run이 자동으로 고릅니다.
03 / 06
예제
기본 검색부터 스크립트에 넣을 만한 형태까지.
이름 없이 — 설치된 것 중에서 대화형으로 고릅니다.
$ omm run특정 모델을 실행하고, 러너는 run이 자동으로 고르게 둡니다.
$ omm run qwen2.5-0.5b-instruct-q4_k_m.gguf같은 모델을 자동 선택 대신 특정 러너로 실행합니다.
$ omm run qwen2.5-0.5b-instruct-q4_k_m.gguf --engine lmstudio04 / 06
실제 실행 예시
2026-08-25, 이 개발 머신에서 실제로 실행한 omm run qwen2.5-0.5b-instruct-q4_k_m.gguf 대화입니다 — 실제 실행 중인 Ollama에 실제 설치된 모델로 진짜 질문을 보내고, 돌아온 진짜 생성 답변을 그대로 실었습니다(대본으로 지어낸 대화가 아닙니다). "Started Ollama in the background for this chat."가 이번 실행엔 안 나오는 건 이미 Ollama가 실행 중이었기 때문입니다 — omm run은 자기가 직접 데몬을 띄웠을 때만 이 줄을 출력합니다.
06 / 06
문제가 생겼다면
아래 메시지는 모두 이 명령이 실제로 출력하는 것들입니다. 해당하는 메시지를 찾아 원인을 읽고, 마지막 줄대로 하면 됩니다.
totally-fake-model-xyz is not installed via omm. See `omm list`.- 원인
- 이 이름은 omm이 이 머신에 설치한 것 중 어디에도 없습니다 — 철자가 틀렸거나, omm을 거치지 않고 러너에 직접 설치됐을 수 있습니다.
- 대처
- omm list로 omm이 알고 있는 정확한 파일명을 확인한 다음 그걸 넘기세요.
- 출처
- src/omm/cli.py:5536
Ollama is not installed. Install it from https://ollama.com/download.- 원인
- run이 Ollama를 골랐거나(또는 지정했는데), 이 머신에서 Ollama 설치를 찾지 못했습니다.
- 대처
- 메시지의 링크에서 Ollama를 설치한 다음 다시 시도하세요.
- 출처
- src/omm/launcher.py:170
`ollama run mistral-7b-instruct-v0.2.q4_k_m` exited with code 1. Try `omm link --engine ollama` to repair the model's Ollama link.- 원인
- 모델은 Ollama에 연결돼 있지만 ollama run 자체가 실패했거나 연결이 오래돼 깨졌습니다.
- 대처
- omm link --engine ollama로 연결을 다시 검증·복구한 다음 다시 시도하세요.
- 출처
- src/omm/launcher.py:177-183
그래도 해결되지 않는다면, 화면에 뜬 메시지 그대로를 첨부해 이슈를 등록하세요.
전체 명령어
- omm search큐레이션 카탈로그, HuggingFace, ModelScope에서 모델을 한 번에 찾습니다.
- omm install모델을 허브에 내려받아 설치된 모든 러너에 연결합니다.
- omm recommend이 머신 하드웨어에 맞춰 순위 매긴 모델을 추천하고, 설치까지 제안합니다.
- omm contribute모델을 반복 벤치마크하며 텔레메트리를 업로드해, 이런 하드웨어용 recommend를 개선합니다.
- omm setup하드웨어 스캔과 러너 설치 체크리스트를 언제든 다시 실행합니다.
- omm scan이 머신의 하드웨어·감지된 러너·모델을 보여줍니다 — 옵션 없이 바로.
- omm tune모델에 맞는 컨텍스트 길이·GPU 오프로드·스레드·배치 크기 추천값을 받습니다.
- omm fit설치 여부와 상관없이 지금 이 머신 여유 메모리에 모델이 맞는지 봅니다.
- omm helpomm 자체 명령어 요약, 또는 --all로 전체 레퍼런스를 봅니다.
- omm import다른 앱의 모델 디렉터리에 있는 .gguf 파일을 omm 허브로 편입시킵니다.
- omm uninstall모델을 제거하고 심볼릭 링크·매니페스트를 정리합니다. 별칭: rm.
- omm listomm이 설치한 모든 모델과 각각 어떤 러너에 연결돼 있는지 봅니다. 별칭: ls.
- omm info설치된 모델 하나의 저장소·버전·크기·링크·실행 명령을 자세히 봅니다.
- omm upgrade설치된 모델을 소스 기준으로 새로고침 — 실제로 바뀐 것만 다시 내려받습니다. 별칭: up.
- omm link설치된 모든 모델의 러너 링크를 다시 확인·복구하거나, 커스텀 디렉터리에 링크합니다.
- omm cleanup남은 부분 다운로드와 깨진 러너 심볼릭 링크를 한 번에 정리합니다 — 옵션 없이 바로.
- omm verify설치된 모델이 이 머신에서 실제로 로드되고 텍스트를 생성하는지 증명합니다.
- omm benchmark설치된 모델 하나 이상의 로컬 품질·속도 증거를 남깁니다.
- omm update최신 소스로 omm을 재설치하고 추천 데이터를 새로고침합니다.
- omm settingomm 설정을 보거나 바꿉니다 — 텔레메트리·외부 전송 데이터·테마·업데이트 채널 등.
- omm doctoromm 설치와 Ollama 링크를 읽기 전용으로 진단합니다 — 옵션 없이 바로.
- omm engine install설정 체크리스트를 건너뛰고 로컬 AI 러너 하나를 바로 설치합니다.
- omm log로컬 실행 로그를 읽습니다 — omm이 뭘 실행했고 잘 됐는지.
- README — UsageEvery omm command, one line each.