블로그
카테고리
태그
LLM
2026.09.13
BioMistral 7B: 100% 오프라인 진료실 폐쇄망에서 구동하는 오픈소스 의학 특화 LLM 설치 가이드
2026.09.11
GPT-6 아스트라 x 고도 엔진: AI Slop 없는 턴제 RPG 게임 제작 풀 가이드
2026.09.10
지상 최고의 AI Agent: 메타 뮤즈(Muse)와 24시간 클라우드 비서의 등장
2026.09.08
왜 고수들은 코덱스 에포트(Effort)를 낮게 쓸까: 모델별 최적 구간과 오버씽킹 방지법
2026.09.08
GPT-6 아스트라와 NC AI의 결합: 프롬프트 하나로 완성하는 3D 게임 개발 워크플로우
2026.09.08
초보자도 가능한 vLLM 서빙 속도 최적화 가이드: 3가지 핵심 튜닝
2026.09.07
Happy-LLM: 밑바닥부터 직접 구현하는 대형 언어 모델(LLM) 오픈소스 실습 교재
2026.09.03
로컬 LLM 구축 현실과 하드웨어 가이드: AMD Radeon R9700 32GB와 Hermes 에이전트 실전
2026.09.03
LLM 신경망 학습부터 추론 원리와 AX 실무 의사결정 프레임워크 (프롬프트 vs RAG vs 파인튜닝)
2026.09.03
TurboFieldfare: 26B 대형 LLM을 RAM 2GB로 구동하는 Swift/Metal 온디바이스 오픈소스
2026.08.31
RAG와 Graph 완전 정복: 원리 이해부터 Local RAG 구축 및 실패 원인 디버깅 실습
2026.08.28
Audio8 TTS: 0.6B 크기로 11개 언어와 제로샷 음성 복제를 지원하는 초경량 CPU 구동 오픈소스
2026.08.28
Qwen3.8-Flash-Next 무검열판 공개: 어블리터레이션 기법으로 지능 손실 없이 거절만 제거한 원리
2026.08.28
GLM-5.3-Flash: OpenRouter 1위 320B MoE 모델의 3비트 GGUF 공개와 RAM 128GB 로컬 구동
2026.08.26
NELLA: 사내 문서 기반 QA 데이터셋 합성부터 파인튜닝·평가까지 자동화하는 Agentic LLMOps
2026.08.22
llmfit: 내 PC 사양(VRAM·RAM)을 자동 분석하여 최적의 로컬 LLM을 추천하는 Rust 오픈소스 도구
2026.08.22
RAG vs CAG: KV 캐시 기반 Cache-Augmented Generation과 LMCache 하이브리드 아키텍처
2026.08.22
OpenViking: 바이트댄스가 공개한 자가진화형 파일시스템 에이전트 컨텍스트 데이터베이스 분석
2026.08.19
ScrapeGraphAI: LLM과 유향 그래프(Graph) 기반 차세대 Python 웹 스크래핑 라이브러리 분석
2026.08.19
Qwen 3.8-27B 무검열(Uncensored) MLX 버전 공개: 안전 가드레일 제거와 거부율 0%대 하락 분석
2026.08.11
한국 주식 MCP 서버: API 키 없는 무료 KOSPI·KOSDAQ 데이터 커넥터 분석
2026.08.08
FreeLLMAPI: 29개 AI 프로바이더의 무료 티어를 하나로 묶는 오픈소스 통합 라우터 분석
2026.07.31
에이전트 AI는 정말 몰락했을까: 기업의 비용 통제를 팩트체크했다
2026.07.07
NVIDIA LocateAnything가 빠른 이유: Parallel Box Decoding이 바운딩 박스를 한 번에 예측하는 방식
2026.07.02
최고의 에이전트 프레임워크는 없다: LangGraph, Agents SDK, LlamaIndex, ADK, Mastra를 고르는 진짜 기준
2026.06.06
Open Notebook이 흥미로운 이유: NotebookLM 클론이 아니라 프라이버시·멀티모델·자기호스팅 연구 운영체제를 지향한다
2026.06.04
TradingAgents는 왜 계속 커지나: 멀티에이전트 투자 실험에서 운영형 리서치 CLI로 진화하는 방식
2026.05.29
Gemini 환각을 줄이는 '비장의 치트키'의 정체: 모델을 바꾸는 게 아니라 개인 맞춤 지침으로 답변 규칙을 강하게 거는 방법
2026.05.20
Claude·ChatGPT·Gemini를 나눠 쓰는 8가지 업무 프롬프트: 회의자료부터 경쟁사 분석까지
2026.05.19
TradingAgents가 흥미로운 이유: '주식 추천 봇'이 아니라 증권사 조직도를 LLM 팀으로 옮긴 프레임워크
2026.05.19
LangGraph를 배워야 하는 이유를 한 문장으로 줄이면: '알아서 해줘'가 아니라 '어떻게 움직일지 설계한다'
2026.05.17
Karpathy의 한 장짜리 LLM Wiki 문서는 정말 RAG의 종말을 말하나
2026.05.16
NVIDIA Build는 진짜로 무료 AI API를 주나: 모델 카탈로그와 Free Endpoint를 구분해서 봐야 하는 이유
2026.05.13
Ethernet이 아니라 Thunderbolt RDMA가 병목을 깼다: 4대의 Mac Studio로 2TB 로컬 AI 클러스터 만들기
2026.05.05
veRL이 중요한 이유: LLM RL의 병목을 3D-HybridEngine과 HybridFlow로 푼다
2026.04.17
Graphify는 왜 토큰을 71.5배 아끼나: 지식 그래프로 코드베이스를 먼저 읽는 방식
2026.04.12
Gemma 4를 Colab에서 파인튜닝하는 가장 현실적인 경로: Unsloth 실습 흐름 정리
2026.04.06
Karpathy의 LLM Wiki: RAG 대신 누적되는 영속적 위키라는 발상
2026.03.25
컨텍스트 로트(context rot): 긴 문맥이 길수록 AI가 흐려지는 이유
2026.03.21
vLLM이 Ollama보다 빠른 이유: PagedAttention, Continuous Batching, 그리고 벤치마크 해석
««
«
1
2
»
»»
카테고리
3D Printing
AI
Automation
Data
Design
Developer Tools
Development
Engineering
Finance
Infrastructure
Insights
Product
Productivity
Prompt Engineering
Security
Web
경제
태그
3d-Modeling
3d-Printing
9Router
Agent
Agent Harness
Agent Skills
Agent-Md
Agentic Workflow
Agents
Ai
AI Agent
AI Agents
AI Coding
AI Engineering
AI Tools
Ai-Video
Analytics
Animation
Anthropic
Api
Api-Keys
Apple Silicon
Architecture
Artifacts
Audio-Ai
Automation
Aws
Backend
Bambu-Studio
Bambulab
Blender
Browser Agent
Bumpmesh
Business
Chatgpt
Chrome
Claude
Claude-Code
Claude
CLI
Code Review
Codebase
Codex
Coding
Coding Agents
Cognitive-Debt
Command Code
Computervision
Content
Context
Context-Engineering
Control-Plane
Css
Ctx2Skill
Data-Engineering
Database
Debugging
Design
Design Patterns
Design System
Design-Systems
Developer-Tools
Devops
Discord
Docker
Documents
Engineering
Fact-Check
Finance
Finetuning
Forecasting
Frontend
Fuzzy-Skin
Game Dev
Gamedev
Games
Gemini
Gemma
Generative Media
Git
GitHub
Goals
Google Stitch
Gpt
Gpu
Graph
Graph-Engineering
Graphify
GSD
Gstack
Hardware
Harness
Harness Engineering
Hermes
Higgsfield
Hooks
HTML
Hunyuan3d
Image Generation
Indie
Infrastructure
Javascript
Jira
Jupyter
Karpathy
Kimi
Knowledge Graph
Knowledge-Management
Korean-Law
Langgraph
Learning
Legal-Tech
LLM
Llm-Wiki
Local-Ai
Local-Llm
Loop-Engineering
Macos
Maker
Markdown
Marketing
Mcp
Memory
Messaging
Midjourney
MLX
Mobile
Model-Router
Models
Multi-Agent
Notebooklm
Notion
NVIDIA NIM
Obsidian
Ollama
Open Generative AI
Open Source
Openai
Opencode
Opensource
Orca-Slicer
Personalization
Pi
Planning
Plugins
Postgresql
PPT
Pptx
PR Review
Presentation
Product-Engineer
Productivity
Project-Management
Prompt-Engineering
Prompting
Prompts
Proxy
Python
Quant
Qwen
Rag
React
Retrieval
RLHF
Routines
Routing
Rust
Search
Security
Seedance
Settings
Shorts
Skills
Slicer
Slides
Software-Engineering
Specifications
Sqlite
Ssh
Startup
Stocks
Storyboard
Supabase
Superpowers
Supports
Sycophancy
Telegram
Tencent
Terminal
Testing
Timeseries
Tmux
Tode
Token
Token-Saving
Tokens
Tools
Trading
Training
Troubleshooting
Tts
Typescript
Vector
Verification
Vibe-Coding
Video
Video AI
Video-Generation
Visual Editor
Voice-Cloning
VPS
Vscode
Warp
Web-Dev
Web-Scraping
Webui
Workflow
Writing
주식
투자
팩트체크