TextGen (text-generation-webui)가 포터블 빌드로 네이티브 데스크톱 앱이 되다
TextGen(구 text-generation-webui, oobabooga로도 알려짐)이 네이티브 데스크톱 앱 버전을 출시했습니다. 2022년 12월부터 개발 중인 이 프로젝트는 이제 휴대용 빌드를 제공합니다. 다운로드하고 압축을 푼 다음 textgen을 더블클릭하기만 하면 됩니다. 설치나 추출된 폴더 외부의 파일이 필요 없습니다. 모든 채팅 기록과 설정은 번들로 제공되는 user_data 폴더에 저장됩니다.
주요 기능
- 프라이버시: 외부 요청이 전혀 없습니다. LM Studio와 달리 OS, CPU, 앱 버전, 백엔드 선택 등에 대한 정보를 외부로 전송하지 않습니다.
- ik_llama.cpp 빌드: LM Studio와 Ollama가 사용하는 일반 llama.cpp보다 더 나은 정확도를 위해 IQ4_KS, IQ5_KS와 같은 맞춤형 양자화 타입을 제공합니다.
- 내장 웹 검색:
ddgsPython 라이브러리를 사용합니다. 두 가지 모드:web_search도구를 호출하는 도구 호출 모드(Qwen 3.6 및 Gemma 4에서 작동) 또는 검색 결과를 텍스트 첨부 파일로 가져오는 체크박스 모드. - 도구 호출: 단일 파일 .py 도구(쉬운 사용자 정의 함수), HTTP MCP 서버, stdio MCP 서버를 지원합니다. 도구 호출 전에 승인/거부 확인을 요구하는 옵션도 있습니다. 가이드 보기.
- 커스텀 캐릭터: 지시 수행 대화와 함께 캐주얼 채팅을 위한 캐릭터를 만들 수 있습니다.
- API 호환성: OpenAI 및 Anthropic 스펙과 호환되는 API. Claude Code와 함께 사용 가능:
ANTHROPIC_BASE_URL=http://127.0.0.1:5000 claude. - PDF 추출: 정확한 텍스트 추출을 위해 PyMuPDF를 사용합니다.
- 웹 페이지 가져오기:
trafilatura를 사용하여 탐색/보일러플레이트를 제거, 에이전트 루프에서 토큰을 절약합니다. - Jinja2 템플릿: Python Jinja2를 통해 채팅 템플릿을 렌더링하여 llama.cpp의 C++ jinja 재구현에서 발생하는 충돌을 방지합니다.
사용 가능한 빌드
CUDA, Vulkan, CPU 전용, Mac(Apple Silicon 및 Intel), ROCm. 모두 휴대용입니다.
라이선스: AGPLv3. 소스: https://github.com/oobabooga/textgen
📖 전체 글 읽기: r/LocalLLaMA
👀 See Also

Eä: 러스트로 작성된 파이썬용 SIMD 컴파일러
한 개발자가 약 12,000줄의 Rust로 SIMD 커널용 컴파일러인 Eä를 구축했습니다. 이 컴파일러는 .ea 파일에서 공유 라이브러리와 Python 래퍼를 생성하며, ctypes나 빌드 시스템 없이 NumPy 대비 6.6배의 속도 향상을 달성했습니다.

오픈라우터 모델 가격 및 달러당 인텔리전스 분석
한 레딧 사용자가 16개 AI 모델의 OpenRouter API 가격을 정리하고 지능-대비-달러 가치를 계산하여, MiMo-V2-Flash를 100만 토큰당 0.09달러로 최고의 가성비 모델로, GPT-5.4를 100만 토큰당 2.50달러로 가장 지능적인 모델로 선정했습니다.

/compress-architecture: 과도한 엔지니어링을 제거하는 에이전트 기술
/compress-architecture라는 새로운 에이전트 스킬은 코드베이스에서 추측성 레이어, 단순 전달 모듈, 중복 개념을 감사하면서 실제 도메인 경계와 공개 API를 보호합니다.

하이퍼리서치: 오픈소스 클로드 코드 스킬 하네스가 딥 리서치 에이전트로 변환시키다
HyperResearch는 Claude Code를 16단계 심층 연구 파이프라인으로 변환하며, 지속적인 지식 저장소, 사실 확인, 인증된 웹 세션을 제공합니다. 오픈 소스, 단일 명령 설치로 DeepResearch Bench에서 OpenAI와 Google을 능가합니다.