LLM Wiki

moe

5건의 항목

  • 2026년 7월 30일

    TurboFieldfare — Apple Silicon에서 Gemma 4 26B-A4B를 약 2GB RAM으로 추론

    • ai-models
    • dev-tools
    • llm
    • local-ai
    • apple-silicon
    • metal
    • swift
    • moe
    • inference
  • 2026년 7월 25일

    POCKET — GPU 없이 CPU로 실행하는 온디바이스 MoE LLM

    • ai-models
    • on-device-llm
    • edge-ai
    • cpu-inference
    • moe
    • quantization
  • 2026년 7월 17일

    같은 문제를 절반 토큰으로, Thinking Machines의 새 오픈모델 Inkling

    • ai-models
    • open-source
    • multimodal
    • moe
    • agentic
  • 2026년 4월 13일

    Flash-MoE — 순수 C/Metal로 M3 Max에서 397B MoE 모델 실행

    • ai-models
    • apple-silicon
    • metal
    • moe
    • inference
  • 2026년 3월 24일

    iPhone 17 Pro에서 400B LLM 실행하기

    • ai-models
    • llm
    • ios
    • moe
    • qwen