전체 글 53

Ollama JSON 출력 고정하기: Python·Pydantic으로 추출 결과 검증

Ollama JSON 출력을 프로그램에서 사용하려면 “JSON으로 답해줘”라는 요청에 더해 필드와 타입을 정하고 결과를 검증하는 과정이 필요합니다. 이 글은 로컬 LLM으로 문서나 요청문의 정보를 추출하려는 Python 개발자를 위한 실습입니다. 입력 문장에서 제품명과 수량을 추출해 검증된 JSON 파일로 저장합니다.목표와 준비사항목표는 다음 문장을 product, quantity 필드로 바꾸는 것입니다.USB-C 케이블 3개를 주문합니다.로컬 Ollama와 Python 3.10 이상이 설치돼 있고, 자신의 컴퓨터에서 실행할 수 있는 로컬 모델이 준비돼 있어야 합니다. 이 글은 Ollama 설치 자체가 아닌 구조화 출력 구현에 집중합니다.ollama --versionollama listpython --v..

정보/Tutorial 16:55:29

Docker port is already allocated 해결: Windows 포트 충돌 확인 순서

Docker port is already allocated 오류는 컨테이너가 사용할 호스트 포트를 확보하지 못할 때 나타납니다. Windows에서 Docker Desktop이나 Compose로 개발 서버를 실행하다 막힌 사용자를 위한 글입니다. 점유 주체를 확인하고 호스트 포트를 바꾼 뒤 접속을 검증하는 순서로 해결합니다.적용 범위는 로컬 Windows의 Docker Desktop과 일반적인 TCP 포트 매핑입니다. 아래 명령은 PowerShell에서 실행하며, 예시는 호스트 8080번과 컨테이너 80번 포트를 사용합니다.Docker port is already allocated: 어느 포트가 겹쳤을까?Bind for 0.0.0.0:8080 failed: port is already allocated80..

Python ModuleNotFoundError 해결: 설치 위치와 실행 환경 확인하기

pip 설치 후 ModuleNotFoundError가 계속된다면 패키지를 설치한 Python과 코드를 실행하는 Python이 같은지 먼저 확인해야 합니다. 이 글은 Windows와 VS Code에서 설치는 끝났는데 import가 실패하는 사용자를 위한 해결 가이드입니다. 실행 경로와 설치 위치를 비교하고, 필요한 환경에 설치한 뒤 정상적으로 불러오는지 확인하는 순서로 진행합니다.적용 범위: Windows의 일반적인 Python 3 개발 환경과 VS Code Python 확장. 명령어 예시는 PowerShell 기준이며, Beautiful Soup을 예시 패키지로 사용합니다.1. pip 설치 후 ModuleNotFoundError가 발생하는 이유다음 오류는 실행 중인 Python이 bs4라는 모듈을 찾지 ..

Mamba

Mamba와 Attention Hybrid: 2026년 LLM은 왜 Transformer만 쓰지 않을까?대형 언어 모델의 Context Length가 점점 길어지면서 새로운 문제가 중요해지고 있습니다.바로:수십만 개의 Token을 어떻게 효율적으로 처리할 것인가?입니다.Transformer의 핵심인 Attention은 매우 강력합니다.하지만 Sequence가 길어질수록 계산량과 메모리 사용량이 크게 증가합니다.그래서 등장한 대표적인 대안이 State Space Model(SSM)이고, 현재 가장 유명한 SSM 계열 아키텍처가 Mamba입니다.그런데 최근 LLM들은 Transformer를 완전히 버리고 Mamba만 사용하는 방향으로 가지 않고 있습니다.오히려:Mamba+Attention+Sparse MoE..

공부/LLM 공부 2026.09.04

MoE (Mixture-of-Experts)

MoE부터 LatentMoE까지: 2026년 LLM 아키텍처의 핵심 변화대형 언어 모델(LLM)의 성능을 높이는 가장 단순한 방법은 모델의 파라미터를 늘리는 것입니다.하지만 모델이 커질수록 문제가 생깁니다.Parameter ↑ ↓Model Capacity ↑ ↓연산량(FLOPs) ↑메모리 사용량 ↑추론 비용 ↑예를 들어 Dense Transformer가 70B 규모라면, 추론 과정에서 대부분의 파라미터가 계속 계산에 참여합니다.이 문제를 해결하기 위해 등장한 대표적인 구조가 Mixture-of-Experts(MoE) 입니다.최근에는 여기서 한 단계 더 나아가, 단순히 계산량만 줄이는 것이 아니라 메모리와 GPU 간 통신 비용까지 줄이기 위한 LatentMoE가 등장하고 있습니다.목차MoE란 무..

공부/LLM 공부 2026.09.04

LLM 기술 스택

대분류핵심기술2026 키워드① 모델 아키텍처Transformer, MoE, SSM/HybridSparse MoE, Mamba+Attention, Active Params② Pre-training대규모 사전학습데이터 품질, synthetic data, compute 효율③ Post-trainingSFT, RL, DistillationRLVR, Agentic RL, Multi-teacher Distillation④ Reasoning추론 능력Test-time Compute, Reasoning Budget, Verifier⑤ Agent도구 사용·행동Harness, Tool Use, Sub-agent, MCP⑥ Context/Memory장기 기억·지식 연결Long Context, Context Engineerin..

공부/LLM 공부 2026.09.04

[논문리뷰] AutoSchemaKG: A Knowledge Graph Construction Framework with Schema Generation and Knowledge Graph Completion

[ref] Bai, J., Fan, W., Hu, Q., Zong, Q., Li, C., Tsang, H. T., ... & Song, Y. (2026, July). Autoschemakg: Autonomous knowledge graph construction through dynamic schema induction from web-scale corpora. In Proceedings of the 64th Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) (pp. 20557-20584).1. 핵심 혁신: '엔티티'를 넘어 '이벤트'와 '개념'으로의 확장기존의 정보 추출(IE) 방식은 명사 위주의..

공부/AutoSchemaKG 2026.07.02

라이센스 문제없는 conda 사용법

학생때는 저작권이니, 논문이니 정말 자유로웠다.학생이라 받은 혜택도 많았다. But, 입사한 이후로 어떤 프로그램을 쓸 때 주의해야한다. 나는 이제까지 Conda를 사용했다.근데 이게 문득 그냥 쓰면 문제가 있을 것 같았다.따라서 저작권, 라이센스 문제 없는 방법을 탐색하였다. miniconda를 설치하여 문법 그대로 사용하면서 라이센스 문제 없도록 방법을 찾았다.방법:1. miniconda 설치2. conda-forge 사용 * conda-forge: 전 세계 커뮤니티가 유지하는 오픈소스 * conda의 defaults 사용 금지, defaults = 회사에서 운영하는 앱스토어 (기업용 라이선스 있음)구체적인 방법conda config --remove channels defaultsconda co..

환경설정 2026.04.24