LLM, 모델 아키텍처, 벤치마크 관련 노트 모음


모델

노트설명
2026-04-03-spreadsheet-terminal-benchAI 에이전트 벤치마크 (Kevin Gu)
2026-03-22-chatgpt-thinking-mode-model-sizeChatGPT Thinking Mode - 모델 체급에 따른 특성과 한계
[[summaries/2026-05-28-llm-model-release-timeline2026-05-28-llm-model-release-timeline]]
2026-03-22-cloudflare-workers-ai-large-modelsCloudflare Workers AI — 엣지에서 대형 모델 실행
2026-03-22-github-trending-vllm-project-vllm-omnivLLM Omni — 멀티모달 모델 서빙
2026-03-24-iphone-400b-llmiPhone에서 400B LLM 구동
2026-03-26-qwen3.5-27b-claude-opus-distilled-v2Qwen3.5-27B-Claude-4.6-Opus-Reasoning-Distilled-v2
2026-03-29-minimax-glm-kimi-coding-comparisonMiniMax m2.7 vs GLM-5.1 vs Kimi k2.5 — 코딩 성능 비교
2026-05-19-karpathy-joins-anthropicKarpathy의 Anthropic 합류 — 의미와 파급력
2026-03-31-karpathy-litellm-dependencies-reevaluationGolang 철학 vs Python 의존성 체인 (LiteLLM 사건 이후)
2026-04-05-qwen3-6-plusQwen3.6-Plus
2026-04-16-qwen3-6-35b-a3bQwen3.6-35B-A3B — Qwen의 35B 멀티모달 에이전틱 코딩 모델
2026-04-22-qwen3-6-27b-open-source-agentic-codingQwen3.6-27B — compact size flagship coding, terminal-level agentic coding
2026-04-22-xiaomi-mimo-v2-5-open-source-agents-forwardXiaomi MiMo-V2.5 — 오픈소스 에이전트/장기 실행 작업 강화 모델
2026-04-17-lyra-2-0Lyra 2.0 — 단일 이미지에서 탐색 가능한 3D 월드를 생성하는 NVIDIA 프레임워크
[[summaries/2026-07-12-pytorchkr-topic-11207-joyai-echo-long-audio-visual-generation2026-07-12-pytorchkr-topic-11207-joyai-echo-long-audio-visual-generation]]
2026-04-05-mac-mini-ollama-gemma4-setupMac mini Ollama + Gemma 4 설정
[[summaries/2026-09-04-news-hada-33182-local-llm-mac-mini2026-09-04-news-hada-33182-local-llm-mac-mini]]
2026-04-08-gemma4-openclaw-ollama-3stepsGemma 4 + OpenClaw 3단계 로컬 구동
2026-04-15-supergemma4-geeknews-coverageSuperGemma4 GeekNews coverage — Gemma 4 26B 비검열/속도개선/양자화 소개
2026-04-08-claude-mythos-preview-benchmarksClaude Mythos Preview 벤치마크
2026-04-15-fe-developer-ai-dsl-assistantFE 개발자의 AI 활용 사례와 DSL Assistant 논문을 연결한 보존 메모
2026-04-15-anthropic-opus-4-7-ai-design-toolAnthropic이 Opus 4.7과 함께 프롬프트 기반 디자인 툴까지 위로 확장하려는 신호
2026-04-16-claude-opus-4-7-releaseOpus 4.7 정식 출시 — 코딩·장기 작업·비전 향상과 새 사이버 가드레일을 함께 발표
2026-04-26-openai-monitorability-evalsOpenAI가 CoT monitorability를 안전 평가 인프라로 공개한 데이터셋/코드 묶음
2026-07-17-openai-gpt-redGPT-Red를 활용한 자동화 레드팀과 프롬프트 인젝션 방어 훈련
2026-04-15-gemini-3-1-flash-tts자연어 지시와 오디오 태그로 스타일을 제어하는 Google의 최신 TTS 모델
2026-04-16-openai-oauth-chatgpt-account-openai-apiChatGPT/Codex OAuth 캐시를 OpenAI 호환 localhost 프록시로 재노출하는 비공식 프로젝트
2026-04-16-chatgpt-for-excelOpenAI가 Excel 리본 안으로 들어가 자연어 기반 시트 생성·분석·수정을 제공하는 공식 애드인
2026-04-16-ai-error-analysis-automationSentry→n8n→Gemini→Notion으로 에러 triage를 자동화하는 운영 패턴
2026-04-16-ai-fails-without-judgment테스트와 자동화가 늘어도 구조 판단은 인간이 맡아야 한다는 실무 에세이
2026-04-16-cal-com-closed-source-securityCal.com이 AI 기반 취약점 탐지를 이유로 프로덕션 제품을 닫고 Cal.diy만 MIT로 남긴 전환 사례
2026-04-16-stanford-ai-index-2026Stanford AI Index 2026 — 성능 가속, 미중 격차 축소, 안전·노동·환경 비용을 함께 읽는 연간 상태 보고서
2026-04-16-pi-autoresearch-geeknewsKarpathy식 autoresearch를 테스트·빌드·Lighthouse까지 확장한 범용 자율 실험 루프 정리
2026-04-20-kimi-k2-6Kimi K2.6 — 장기 실행 코딩, Agent Swarm, 툴 호출 안정성을 강화한 Moonshot AI의 오픈소스 모델
2026-04-25-ai-model-category-picks2026-04-25 기준 카테고리별 최고의 AI를 실사용 축으로 정리한 메모
2026-04-20-kimi-k2-6-vs-qwen3-6-vs-opus-4-7Kimi K2.6, Qwen3.6, Opus 4.7을 실무 선택 기준으로 비교한 코딩 에이전트 모델 가이드
2026-06-14-artificial-analysis-deepswe-coding-agent-indexCoding Agent Index 개편 — SWE-Bench Pro→DeepSWE 교체로 순위 재정렬, Fable 5 1위 데뷔
2026-07-12-artificial-analysis-intelligence-indexArtificial Analysis Intelligence Index v4.1 — 9개 평가 종합, 상위 50개 모델 점수 스냅샷 (1위 Fable 5 60점)
[[summaries/2026-07-12-hada-31342-gpt-5-6-model-app-build-off2026-07-12-hada-31342-gpt-5-6-model-app-build-off]]
glm-5.2GLM-5.2 — Z.ai coding-first 1M 컨텍스트 모델 (2026-06-13, 벤치 미공개)
kimi-k2-7-codeKimi K2.7 Code — Moonshot 코딩 특화 1T MoE 오픈웨이트 (2026-06-12)
claude-fable-5Claude Fable 5 — Anthropic 최강 코딩 모델 (2026-06-09), 미 정부 지시로 접근 중단
[[summaries/2026-07-18-linkedin-sujin-claude-values-models-languages2026-07-18-linkedin-sujin-claude-values-models-languages]]
2026-06-14-new-coding-models-glm-kimi-fable-opus-gpt신규 코딩 모델 6종 비교 — GLM-5.2·Kimi K2.7 Code vs Fable 5·Opus 4.8·GPT-5.5
2026-06-26-glm52-mac-studio-dgx-spark-benchmarkMac Studio 512GB와 DGX Spark에서 GLM-5.2 MLX/GGUF 양자화 조합을 실행한 로컬 벤치마크
2026-07-12-justvugg-colibriGLM-5.2 744B MoE를 25GB RAM 소비자 기기에서 디스크 스트리밍으로 실행하는 순수 C 엔진
2026-07-17-chinese-open-model-download-share허깅페이스·OpenRouter·Vercel 집계로 본 중국계 오픈웨이트 모델 사용 확대
[[summaries/2026-07-17-pytorchkr-local-llm-gpu-hardware-guide2026-07-17-pytorchkr-local-llm-gpu-hardware-guide]]
2026-07-18-pytorchkr-topic-11283-inkling-975b-moeInkling — 975B 멀티모달 MoE 오픈 웨이트 모델, 사고 노력 조절과 커스터마이징 중심
kimi-k3Kimi K3 — Moonshot 2.8T 오픈웨이트 MoE, 1M 컨텍스트·네이티브 비전·KDA 어텐션 (2026-07-16)
2026-08-05-github-lyogavin-airllmAirLLM — 디스크·MoE 전문가 스트리밍으로 초저VRAM 대형 LLM 추론
2026-07-30-drumih-turbo-fieldfareTurboFieldfare — Gemma 4 26B-A4B를 SSD expert streaming으로 약 2GB RAM에 맞춘 Swift·Metal 런타임

인프라 & 도구

노트설명
2026-03-21-qmdQMD - Query Markup Documents (온디바이스 검색 엔진)
2026-08-09-github-zesuy-plugin-deepseek-visionCLIProxyAPI 호스트 VLM을 활용한 DeepSeek 이미지 전처리·멀티모달 요청 재작성 플러그인
[[summaries/2026-08-09-silicon-photonics-ai-datacenter-bottleneck2026-08-09-silicon-photonics-ai-datacenter-bottleneck]]

신규 유입 아카이브

관련 MOC