hello

ollama 없이 모델 파일을 ollama에서 다운 받기

Share


import json
import os
import sys
from urllib.parse import urljoin, urlunparse

import requests
import urllib3

urllib3.disable_warnings()

DEFAULT_REGISTRY = "registry.ollama.ai"
DEFAULT_NAMESPACE = "library"
DEFAULT_TAG = "latest"
DEFAULT_PROTOCOL_SCHEME = "https"


class Manifest:
    def __init__(
        self,
        schema_version,
        media_type,
        config,
        layers,
        filepath=None,
        file_info=None,
        digest=None,
    ):
        self.schema_version = schema_version
        self.media_type = media_type
        self.config = config
        self.layers = layers
        self.filepath = filepath
        self.file_info = file_info
        self.digest = digest


class Layer:
    def __init__(self, mediaType, digest, size, source=None, status=None):
        self.media_type = mediaType
        self.digest = digest
        self.size = size
        self.source = source
        self.status = status


class ModelPath:
    def __init__(
        self,
        protocol_scheme=DEFAULT_PROTOCOL_SCHEME,
        registry=DEFAULT_REGISTRY,
        namespace=DEFAULT_NAMESPACE,
        repository="",
        tag=DEFAULT_TAG,
    ):
        self.protocol_scheme = protocol_scheme
        self.registry = registry
        self.namespace = namespace
        self.repository = repository
        self.tag = tag

    @classmethod
    def parse_model_path(cls, name):
        mp = cls()

        if "://" in name:
            mp.protocol_scheme, name = name.split("://", 1)

        name = name.replace(os.path.sep, "/")
        parts = name.split("/")

        if len(parts) == 3:
            mp.registry, mp.namespace, mp.repository = parts
        elif len(parts) == 2:
            mp.namespace, mp.repository = parts
        elif len(parts) == 1:
            mp.repository = parts[0]

        if ":" in mp.repository:
            mp.repository, mp.tag = mp.repository.split(":", 1)

        return mp

    def get_namespace_repository(self):
        return f"{self.namespace}/{self.repository}"

    def base_url(self):
        return urlunparse((self.protocol_scheme, self.registry, "", "", "", ""))


def get_manifest(model_path, reg_opts=None):
    request_url = urljoin(
        model_path.base_url(),
        f"v2/{model_path.get_namespace_repository()}/manifests/{model_path.tag}",
    )
    headers = {"Accept": "application/vnd.docker.distribution.manifest.v2+json"}

    try:
        response = requests.get(
            request_url,
            headers=headers,
            auth=reg_opts,
            verify=False,
            proxies={"https": "http://12.26.204.100:8080"},
        )
        response.raise_for_status()
    except requests.RequestException as e:
        print(f"매니페스트를 가져오는 중 오류 발생: {e}")
        return None, request_url

    try:
        manifest_data = response.json()
        config = Layer(**manifest_data.get("config", {}))
        layers = [Layer(**layer) for layer in manifest_data.get("layers", [])]
        manifest = Manifest(
            schema_version=manifest_data.get("schemaVersion"),
            media_type=config.media_type,
            config=config,
            layers=layers,
        )
        return manifest, request_url
    except json.JSONDecodeError as e:
        print(f"JSON 디코딩 오류: {e}")
        return None, request_url


def download_blob(blob_url, output_path, use_tqdm=True):

    try:
        if use_tqdm is None:
            from tqdm import tqdm

            use_tqdm = True
        else:
            use_tqdm = False
    except ImportError:
        use_tqdm = False

    try:
        with requests.get(
            blob_url,
            stream=True,
            verify=False,
            proxies={"https": "http://12.26.204.100:8080"},
        ) as response:
            response.raise_for_status()
            total_size = int(response.headers.get("content-length", 0))
            print(f"Downloading: {blob_url}..., {output_path}")

            with open(output_path, "wb") as file:
                if use_tqdm:
                    with tqdm(
                        desc=os.path.basename(output_path),
                        total=total_size,
                        unit="B",
                        unit_scale=True,
                        unit_divisor=1024,
                    ) as bar:
                        for chunk in response.iter_content(chunk_size=8192):
                            file.write(chunk)
                            bar.update(len(chunk))
                else:
                    print(f"다운로드 중: {os.path.basename(output_path)}")
                    for chunk in response.iter_content(chunk_size=8192):
                        file.write(chunk)
        print(f"Downloaded: {output_path}")
    except requests.RequestException as e:
        print(f"Error downloading blob from {blob_url}: {e}")


def download_model(model_name, output_dir):
    os.makedirs(output_dir, exist_ok=True)

    parsed_model_path = ModelPath.parse_model_path(model_name)
    manifest, manifest_link = get_manifest(parsed_model_path)

    if manifest is None:
        print(f"Failed to fetch manifest for model: {model_name}")
        sys.exit(1)

    layers = manifest.layers + [manifest.config]
    for layer in layers:
        if layer.media_type != "application/vnd.ollama.image.model":
            continue

        blob_url = urljoin(
            parsed_model_path.base_url(),
            f"v2/{parsed_model_path.get_namespace_repository()}/blobs/{layer.digest}",
        )

        output_path = os.path.join(output_dir, model_name.replace(":", "-") + ".gguf")
        if os.path.exists(output_path):
            print("Skipped " + output_path)
        else:
            download_blob(blob_url, output_path)

    print(f"All blobs for model {model_name} downloaded successfully.")


if __name__ == "__main__":
    model_name = "llama3.2:1b"
    output_folder = "temp"
    download_model(model_name, output_folder)

Read more

AI 에이전트 시대의 코드 호스팅: Cursor ‘Origin’은 왜 등장했나

AI 코딩 도구로 빠르게 성장한 Cursor가 이제 코드 에디터를 넘어 코드 호스팅 영역까지 확장하고 있습니다. 2026년 8월 17일 Cursor는 Origin이라는 새로운 코드 호스팅 서비스를 early beta로 공개했습니다. 쉽게 말하면 GitHub처럼 Git 저장소를 만들고, 코드를 올리고, Pull Request(PR)를 만들고 리뷰할 수 있는 서비스입니다. 그런데 단순히 "Cursor가 GitHub 비슷한

By JHL

코딩 에이전트에 1,000억 토큰을 써보니, 병목은 모델 밖에 있었다

Codex 화면에 집계된 누적 사용량은 약 866억 토큰이었다. Claude는 내가 확인할 수 있었던 로컬 머신의 집계값만 합쳐도 약 127억 토큰이었다. 다만 Claude는 여러 워크스테이션과 서버에서 사용했고, 중간에 사용량 데이터를 한 번 날려버리기도 했다. 누락된 머신과 기간을 감안하면 실제 사용량은 300억 토큰을 넘었을 가능성이 높다. 여기에 Ollama Cloud로 사용한 GLM, Qwen

By JHL

AI가 짜준 코드가 배포 속도를 높였다면, 이제는 '신뢰성 가드레일'을 세울 때입니다

최근 많은 팀이 AI 코딩 어시스턴트나 에이전트를 도입하면서 코드 생산 속도가 비약적으로 상승했습니다. 하지만 속도가 빨라졌다는 것은 그만큼 잠재적인 결함이 프로덕션 환경으로 유입되는 속도 또한 빨라졌음을 의미합니다. DevOps.com의 이번 글은 AI가 생성한 코드의 특성과 그로 인해 발생하는 새로운 유형의 리스크, 그리고 이를 제어하기 위한 '신뢰성 가드레일(Reliability Guardrails)

By JHL

LLM 시대, 프롬프트 엔지니어링보다 '도메인 전문성'이 더 강력한 무기인 이유

최근 AI 도구들이 비약적으로 발전하면서 '프롬프트 엔지니어링'이라는 기술적 기법에 많은 관심이 쏠렸습니다. 하지만 실제 현업에서 LLM을 극한으로 활용해 고도의 결과물을 만들어내는 사람들의 공통점은 정교한 프롬프트 템플릿을 쓰는 능력이 아니라, 해당 분야에 대한 깊은 '도메인 전문성'을 갖추고 있다는 점입니다. 많은 이들이 LLM이 지식의 격차를 줄여준다고

By JHL