Ollama의 동시 요청 처리 방식
Ollama의 동시성, 대기열 처리 방식, 그리고 안정적이고 병렬적인 요청을 위해 OLLAMA_NUM_PARALLEL을 조정하는 방법을 이해하세요.
이 가이드는 Ollama가 병렬 요청을 처리하는 방법(동시성, 대기열, 자원 제한)과 OLLAMA_NUM_PARALLEL 환경 변수(및 관련 설정 항목)를 사용하여 이를 조정하는 방법을 설명합니다.
Ollama의 동시성, 대기열 처리 방식, 그리고 안정적이고 병렬적인 요청을 위해 OLLAMA_NUM_PARALLEL을 조정하는 방법을 이해하세요.
이 가이드는 Ollama가 병렬 요청을 처리하는 방법(동시성, 대기열, 자원 제한)과 OLLAMA_NUM_PARALLEL 환경 변수(및 관련 설정 항목)를 사용하여 이를 조정하는 방법을 설명합니다.
타이핑이 아닌 설명으로 이루어지는 AI 지원 코딩
Vibe coding 은 개발자가 자연어로 원하는 기능을 설명하면 AI 도구가 코드를 자동으로 생성하는 AI 기반 프로그래밍 접근 방식입니다. 직접 코드를 작성하는 양은 최소화합니다.
두 개의 deepseek-r1 모델을 두 개의 기본 모델과 비교합니다.
DeepSeek’s 첫 세대 추론 모델로, OpenAI-o1과 유사한 성능을 보입니다. 이 모델은 Llama와 Qwen을 기반으로 한 DeepSeek-R1에서 추출한 6개의 밀집 모델입니다.
Ollama 명령어 목록 업데이트 - ls, ps, run, serve 등
이 Ollama CLI 치트시트는 매일 사용하는 명령어(ollama ls, ollama serve, ollama run, ollama ps, 모델 관리, 일반적인 워크플로)에 초점을 맞추고 있으며, 복사/붙여넣기할 수 있는 예제를 제공합니다.
LLM 테스트 다음 라운드
지난 시간에 새로운 버전이 출시되었습니다. 지금까지의 내용을 확인하고, 기타 LLM과 비교하여 Mistral Small의 성능을 테스트해보세요.
RAG의 재순위화를 위한 Python 코드
놀랍도록 새로운 AI 모델로 텍스트에서 이미지 생성
최근 Black Forest Labs는 텍스트에서 이미지로 생성하는 AI 모델을 출시했습니다. 이 모델들은 매우 높은 출력 품질을 자랑한다고 알려져 있습니다. 시작해 보세요
두 개의 자체 호스팅 AI 검색 엔진 비교
아름다운 음식은 눈으로도 즐길 수 있는 즐거움입니다. 하지만 이번 포스팅에서는 두 가지 AI 기반 검색 시스템인 Farfalle 와 Perplexica 를 비교해 보겠습니다.
로컬에서 코파일럿 스타일 서비스를 실행하시나요? 간단합니다!
정말 흥미진진합니다!
코파일럿 (Copilot) 이나 perplexity.ai 에 접속하여 전 세계에 당신의 의도를 알릴 필요 없이, 이제 자신의 PC 나 노트북에서 유사한 서비스를 직접 호스팅할 수 있습니다!
논리적 오류 탐지 테스트
최근 몇몇 새로운 LLM이 출시되었습니다. 흥미로운 시기입니다. 논리적 오류를 감지하는 데 이 모델들이 어떻게 수행되는지 테스트해 보겠습니다.
선택지가 많지는 않지만 그래도....
LLM 실험을 처음 시작했을 당시, 관련 UI는 활발하게 개발 중이었으며 현재는 그 중 일부가 매우 우수합니다.
일부 실험을 필요로 하지만
아직도 LLM이 당신이 원하는 것을 이해하려고 애를 쓰지 않도록 하기 위해 효과적인 프롬프트를 작성하는 데 사용되는 일반적인 접근 방법이 몇 가지 있습니다.
8개의 llama3 (Meta+) 및 5개의 phi3 (Microsoft) LLM 버전
다양한 파라미터 수와 양자화된 모델들이 어떻게 작동하는지 테스트해보았습니다.
Ollama LLM 모델 파일은 많은 용량을 차지합니다
ollama 설치 후 ollama를 재설정하여 바로 모델을 새로운 위치에 저장하는 것이 좋습니다. 이렇게 하면 새 모델을 pull할 때, 이전 위치로 다운로드되지 않습니다.
GPU 대 CPU에서 LLM의 속도를 테스트해 보겠습니다.
다양한 버전의 LLM(llama3, phi3, gemma, mistral)의 예측 속도를 CPU와 GPU에서 비교합니다.
다양한 LLM의 논리적 오류 탐지 품질을 테스트해 보겠습니다.
여기에서 저는 여러 LLM 버전을 비교하고 있습니다: Llama3 (Meta), Phi3 (Microsoft), Gemma (Google), Mistral Nemo(Mistral AI), Qwen(Alibaba).