LLM, 모델 아키텍처, 벤치마크 관련 노트 모음
모델
| 노트 | 설명 |
|---|---|
| 2026-04-03-spreadsheet-terminal-bench | AI 에이전트 벤치마크 (Kevin Gu) |
| 2026-03-22-chatgpt-thinking-mode-model-size | ChatGPT Thinking Mode - 모델 체급에 따른 특성과 한계 |
| [[summaries/2026-05-28-llm-model-release-timeline | 2026-05-28-llm-model-release-timeline]] |
| 2026-03-22-cloudflare-workers-ai-large-models | Cloudflare Workers AI — 엣지에서 대형 모델 실행 |
| 2026-03-22-github-trending-vllm-project-vllm-omni | vLLM Omni — 멀티모달 모델 서빙 |
| 2026-03-24-iphone-400b-llm | iPhone에서 400B LLM 구동 |
| 2026-03-26-qwen3.5-27b-claude-opus-distilled-v2 | Qwen3.5-27B-Claude-4.6-Opus-Reasoning-Distilled-v2 |
| 2026-03-29-minimax-glm-kimi-coding-comparison | MiniMax m2.7 vs GLM-5.1 vs Kimi k2.5 — 코딩 성능 비교 |
| 2026-05-19-karpathy-joins-anthropic | Karpathy의 Anthropic 합류 — 의미와 파급력 |
| 2026-03-31-karpathy-litellm-dependencies-reevaluation | Golang 철학 vs Python 의존성 체인 (LiteLLM 사건 이후) |
| 2026-04-05-qwen3-6-plus | Qwen3.6-Plus |
| 2026-04-16-qwen3-6-35b-a3b | Qwen3.6-35B-A3B — Qwen의 35B 멀티모달 에이전틱 코딩 모델 |
| 2026-04-22-qwen3-6-27b-open-source-agentic-coding | Qwen3.6-27B — compact size flagship coding, terminal-level agentic coding |
| 2026-04-22-xiaomi-mimo-v2-5-open-source-agents-forward | Xiaomi MiMo-V2.5 — 오픈소스 에이전트/장기 실행 작업 강화 모델 |
| 2026-04-17-lyra-2-0 | Lyra 2.0 — 단일 이미지에서 탐색 가능한 3D 월드를 생성하는 NVIDIA 프레임워크 |
| [[summaries/2026-07-12-pytorchkr-topic-11207-joyai-echo-long-audio-visual-generation | 2026-07-12-pytorchkr-topic-11207-joyai-echo-long-audio-visual-generation]] |
| 2026-04-05-mac-mini-ollama-gemma4-setup | Mac mini Ollama + Gemma 4 설정 |
| [[summaries/2026-09-04-news-hada-33182-local-llm-mac-mini | 2026-09-04-news-hada-33182-local-llm-mac-mini]] |
| 2026-04-08-gemma4-openclaw-ollama-3steps | Gemma 4 + OpenClaw 3단계 로컬 구동 |
| 2026-04-15-supergemma4-geeknews-coverage | SuperGemma4 GeekNews coverage — Gemma 4 26B 비검열/속도개선/양자화 소개 |
| 2026-04-08-claude-mythos-preview-benchmarks | Claude Mythos Preview 벤치마크 |
| 2026-04-15-fe-developer-ai-dsl-assistant | FE 개발자의 AI 활용 사례와 DSL Assistant 논문을 연결한 보존 메모 |
| 2026-04-15-anthropic-opus-4-7-ai-design-tool | Anthropic이 Opus 4.7과 함께 프롬프트 기반 디자인 툴까지 위로 확장하려는 신호 |
| 2026-04-16-claude-opus-4-7-release | Opus 4.7 정식 출시 — 코딩·장기 작업·비전 향상과 새 사이버 가드레일을 함께 발표 |
| 2026-04-26-openai-monitorability-evals | OpenAI가 CoT monitorability를 안전 평가 인프라로 공개한 데이터셋/코드 묶음 |
| 2026-07-17-openai-gpt-red | GPT-Red를 활용한 자동화 레드팀과 프롬프트 인젝션 방어 훈련 |
| 2026-04-15-gemini-3-1-flash-tts | 자연어 지시와 오디오 태그로 스타일을 제어하는 Google의 최신 TTS 모델 |
| 2026-04-16-openai-oauth-chatgpt-account-openai-api | ChatGPT/Codex OAuth 캐시를 OpenAI 호환 localhost 프록시로 재노출하는 비공식 프로젝트 |
| 2026-04-16-chatgpt-for-excel | OpenAI가 Excel 리본 안으로 들어가 자연어 기반 시트 생성·분석·수정을 제공하는 공식 애드인 |
| 2026-04-16-ai-error-analysis-automation | Sentry→n8n→Gemini→Notion으로 에러 triage를 자동화하는 운영 패턴 |
| 2026-04-16-ai-fails-without-judgment | 테스트와 자동화가 늘어도 구조 판단은 인간이 맡아야 한다는 실무 에세이 |
| 2026-04-16-cal-com-closed-source-security | Cal.com이 AI 기반 취약점 탐지를 이유로 프로덕션 제품을 닫고 Cal.diy만 MIT로 남긴 전환 사례 |
| 2026-04-16-stanford-ai-index-2026 | Stanford AI Index 2026 — 성능 가속, 미중 격차 축소, 안전·노동·환경 비용을 함께 읽는 연간 상태 보고서 |
| 2026-04-16-pi-autoresearch-geeknews | Karpathy식 autoresearch를 테스트·빌드·Lighthouse까지 확장한 범용 자율 실험 루프 정리 |
| 2026-04-20-kimi-k2-6 | Kimi K2.6 — 장기 실행 코딩, Agent Swarm, 툴 호출 안정성을 강화한 Moonshot AI의 오픈소스 모델 |
| 2026-04-25-ai-model-category-picks | 2026-04-25 기준 카테고리별 최고의 AI를 실사용 축으로 정리한 메모 |
| 2026-04-20-kimi-k2-6-vs-qwen3-6-vs-opus-4-7 | Kimi K2.6, Qwen3.6, Opus 4.7을 실무 선택 기준으로 비교한 코딩 에이전트 모델 가이드 |
| 2026-06-14-artificial-analysis-deepswe-coding-agent-index | Coding Agent Index 개편 — SWE-Bench Pro→DeepSWE 교체로 순위 재정렬, Fable 5 1위 데뷔 |
| 2026-07-12-artificial-analysis-intelligence-index | Artificial Analysis Intelligence Index v4.1 — 9개 평가 종합, 상위 50개 모델 점수 스냅샷 (1위 Fable 5 60점) |
| [[summaries/2026-07-12-hada-31342-gpt-5-6-model-app-build-off | 2026-07-12-hada-31342-gpt-5-6-model-app-build-off]] |
| glm-5.2 | GLM-5.2 — Z.ai coding-first 1M 컨텍스트 모델 (2026-06-13, 벤치 미공개) |
| kimi-k2-7-code | Kimi K2.7 Code — Moonshot 코딩 특화 1T MoE 오픈웨이트 (2026-06-12) |
| claude-fable-5 | Claude Fable 5 — Anthropic 최강 코딩 모델 (2026-06-09), 미 정부 지시로 접근 중단 |
| [[summaries/2026-07-18-linkedin-sujin-claude-values-models-languages | 2026-07-18-linkedin-sujin-claude-values-models-languages]] |
| 2026-06-14-new-coding-models-glm-kimi-fable-opus-gpt | 신규 코딩 모델 6종 비교 — GLM-5.2·Kimi K2.7 Code vs Fable 5·Opus 4.8·GPT-5.5 |
| 2026-06-26-glm52-mac-studio-dgx-spark-benchmark | Mac Studio 512GB와 DGX Spark에서 GLM-5.2 MLX/GGUF 양자화 조합을 실행한 로컬 벤치마크 |
| 2026-07-12-justvugg-colibri | GLM-5.2 744B MoE를 25GB RAM 소비자 기기에서 디스크 스트리밍으로 실행하는 순수 C 엔진 |
| 2026-07-17-chinese-open-model-download-share | 허깅페이스·OpenRouter·Vercel 집계로 본 중국계 오픈웨이트 모델 사용 확대 |
| [[summaries/2026-07-17-pytorchkr-local-llm-gpu-hardware-guide | 2026-07-17-pytorchkr-local-llm-gpu-hardware-guide]] |
| 2026-07-18-pytorchkr-topic-11283-inkling-975b-moe | Inkling — 975B 멀티모달 MoE 오픈 웨이트 모델, 사고 노력 조절과 커스터마이징 중심 |
| kimi-k3 | Kimi K3 — Moonshot 2.8T 오픈웨이트 MoE, 1M 컨텍스트·네이티브 비전·KDA 어텐션 (2026-07-16) |
| 2026-08-05-github-lyogavin-airllm | AirLLM — 디스크·MoE 전문가 스트리밍으로 초저VRAM 대형 LLM 추론 |
| 2026-07-30-drumih-turbo-fieldfare | TurboFieldfare — Gemma 4 26B-A4B를 SSD expert streaming으로 약 2GB RAM에 맞춘 Swift·Metal 런타임 |
인프라 & 도구
| 노트 | 설명 |
|---|---|
| 2026-03-21-qmd | QMD - Query Markup Documents (온디바이스 검색 엔진) |
| 2026-08-09-github-zesuy-plugin-deepseek-vision | CLIProxyAPI 호스트 VLM을 활용한 DeepSeek 이미지 전처리·멀티모달 요청 재작성 플러그인 |
| [[summaries/2026-08-09-silicon-photonics-ai-datacenter-bottleneck | 2026-08-09-silicon-photonics-ai-datacenter-bottleneck]] |
신규 유입 아카이브
- moc-ai-models-intake-archive — 날짜별 신규 유입·고아 정리 70개를 분리 보관
관련 MOC
-
moc-chinese-llm-models — 중국 LLM 플래그십 7종 가격·특징·벤치마크 비교 (2026-05)
-
2026-07-31-krafton-ax-k2-raon-speech — 한국어·영어 STT/TTS·음성 QA를 통합한 KRAFTON의 21.2B 음성 언어 모델