NemoClaw Knowledge Wiki

Tag: model-acceleration

4 items with this tag.

  • Jul 12, 2026

    self-hosted-llms

    • self-hosted-llms
    • data-sovereignty
    • privacy-protection
    • local-inference
    • private-ai
    • reduced-api-dependency
    • speculative-decoding
    • model-acceleration
  • Jul 11, 2026

    deepspec-toolkit

    • llm-inference
    • model-acceleration
    • deepseek
    • open-source
    • text-generation
    • local-deployment
  • Jul 11, 2026

    multi-token-prediction-mtp-drafter-models

    • multi-token-prediction
    • speculative-decoding
    • llm-inference
    • model-acceleration
    • drafter-models
    • inference-optimization
    • llama.cpp
  • Jul 11, 2026

    multi-token-prediction-mtp

    • token-prediction
    • inference-optimization
    • speculative-decoding
    • llm-efficiency
    • parallel-processing
    • model-acceleration

Created with Quartz v4.5.2 © 2026

  • GitHub
  • Discord Community