2026.09.13 BioMistral 7B: 100% 오프라인 진료실 폐쇄망에서 구동하는 오픈소스 의학 특화 LLM 설치 가이드
2026.09.11 GPT-6 아스트라 x 고도 엔진: AI Slop 없는 턴제 RPG 게임 제작 풀 가이드
2026.09.10 지상 최고의 AI Agent: 메타 뮤즈(Muse)와 24시간 클라우드 비서의 등장
2026.09.08 왜 고수들은 코덱스 에포트(Effort)를 낮게 쓸까: 모델별 최적 구간과 오버씽킹 방지법
2026.09.08 GPT-6 아스트라와 NC AI의 결합: 프롬프트 하나로 완성하는 3D 게임 개발 워크플로우
2026.09.08 초보자도 가능한 vLLM 서빙 속도 최적화 가이드: 3가지 핵심 튜닝
2026.09.07 Happy-LLM: 밑바닥부터 직접 구현하는 대형 언어 모델(LLM) 오픈소스 실습 교재
2026.09.03 로컬 LLM 구축 현실과 하드웨어 가이드: AMD Radeon R9700 32GB와 Hermes 에이전트 실전
2026.09.03 LLM 신경망 학습부터 추론 원리와 AX 실무 의사결정 프레임워크 (프롬프트 vs RAG vs 파인튜닝)
2026.09.03 TurboFieldfare: 26B 대형 LLM을 RAM 2GB로 구동하는 Swift/Metal 온디바이스 오픈소스
2026.08.31 RAG와 Graph 완전 정복: 원리 이해부터 Local RAG 구축 및 실패 원인 디버깅 실습
2026.08.28 Audio8 TTS: 0.6B 크기로 11개 언어와 제로샷 음성 복제를 지원하는 초경량 CPU 구동 오픈소스
2026.08.28 Qwen3.8-Flash-Next 무검열판 공개: 어블리터레이션 기법으로 지능 손실 없이 거절만 제거한 원리
2026.08.28 GLM-5.3-Flash: OpenRouter 1위 320B MoE 모델의 3비트 GGUF 공개와 RAM 128GB 로컬 구동
2026.08.26 NELLA: 사내 문서 기반 QA 데이터셋 합성부터 파인튜닝·평가까지 자동화하는 Agentic LLMOps
2026.08.22 llmfit: 내 PC 사양(VRAM·RAM)을 자동 분석하여 최적의 로컬 LLM을 추천하는 Rust 오픈소스 도구
2026.08.22 RAG vs CAG: KV 캐시 기반 Cache-Augmented Generation과 LMCache 하이브리드 아키텍처
2026.08.22 OpenViking: 바이트댄스가 공개한 자가진화형 파일시스템 에이전트 컨텍스트 데이터베이스 분석
2026.08.19 ScrapeGraphAI: LLM과 유향 그래프(Graph) 기반 차세대 Python 웹 스크래핑 라이브러리 분석
2026.08.19 Qwen 3.8-27B 무검열(Uncensored) MLX 버전 공개: 안전 가드레일 제거와 거부율 0%대 하락 분석
2026.08.11 한국 주식 MCP 서버: API 키 없는 무료 KOSPI·KOSDAQ 데이터 커넥터 분석
2026.08.08 FreeLLMAPI: 29개 AI 프로바이더의 무료 티어를 하나로 묶는 오픈소스 통합 라우터 분석
2026.07.31 에이전트 AI는 정말 몰락했을까: 기업의 비용 통제를 팩트체크했다
2026.07.07 NVIDIA LocateAnything가 빠른 이유: Parallel Box Decoding이 바운딩 박스를 한 번에 예측하는 방식
2026.07.02 최고의 에이전트 프레임워크는 없다: LangGraph, Agents SDK, LlamaIndex, ADK, Mastra를 고르는 진짜 기준
2026.06.06 Open Notebook이 흥미로운 이유: NotebookLM 클론이 아니라 프라이버시·멀티모델·자기호스팅 연구 운영체제를 지향한다
2026.06.04 TradingAgents는 왜 계속 커지나: 멀티에이전트 투자 실험에서 운영형 리서치 CLI로 진화하는 방식
2026.05.29 Gemini 환각을 줄이는 '비장의 치트키'의 정체: 모델을 바꾸는 게 아니라 개인 맞춤 지침으로 답변 규칙을 강하게 거는 방법
2026.05.20 Claude·ChatGPT·Gemini를 나눠 쓰는 8가지 업무 프롬프트: 회의자료부터 경쟁사 분석까지
2026.05.19 TradingAgents가 흥미로운 이유: '주식 추천 봇'이 아니라 증권사 조직도를 LLM 팀으로 옮긴 프레임워크
2026.05.19 LangGraph를 배워야 하는 이유를 한 문장으로 줄이면: '알아서 해줘'가 아니라 '어떻게 움직일지 설계한다'
2026.05.17 Karpathy의 한 장짜리 LLM Wiki 문서는 정말 RAG의 종말을 말하나
2026.05.16 NVIDIA Build는 진짜로 무료 AI API를 주나: 모델 카탈로그와 Free Endpoint를 구분해서 봐야 하는 이유
2026.05.13 Ethernet이 아니라 Thunderbolt RDMA가 병목을 깼다: 4대의 Mac Studio로 2TB 로컬 AI 클러스터 만들기
2026.05.05 veRL이 중요한 이유: LLM RL의 병목을 3D-HybridEngine과 HybridFlow로 푼다
2026.04.17 Graphify는 왜 토큰을 71.5배 아끼나: 지식 그래프로 코드베이스를 먼저 읽는 방식
2026.04.12 Gemma 4를 Colab에서 파인튜닝하는 가장 현실적인 경로: Unsloth 실습 흐름 정리
2026.04.06 Karpathy의 LLM Wiki: RAG 대신 누적되는 영속적 위키라는 발상
2026.03.25 컨텍스트 로트(context rot): 긴 문맥이 길수록 AI가 흐려지는 이유
2026.03.21 vLLM이 Ollama보다 빠른 이유: PagedAttention, Continuous Batching, 그리고 벤치마크 해석