---
type: "CollectionPage"
title: "Blog: #inference-optimization"
description: "Blog posts tagged \"inference-optimization\" from Context Studios."
resource: "https://www.contextstudios.ai/blog/tag/inference-optimization"
language: "en"
generated:
  by: "process:contextstudios-md/1"
  at: "2026-10-02T02:24:15.139Z"
status: "stable"
---

# Blog: #inference-optimization

Blog posts tagged "inference-optimization" from Context Studios.

- [Deltafin: 2.8T Kimi K3 from Four SSDs on a MacBook — Layer Streaming as a Local Inference Lever](https://www.contextstudios.ai/blog/deltafin-2-8t-kimi-k3-from-four-ssds-on-a-macbook-layer-streaming.md)
- [Jev Measured Independently: 92–214 ms per Decision, Under 1 Cent per 8 Requests — and the 25x-vs-200x Catch](https://www.contextstudios.ai/blog/jev-measured-92-214-ms-per-decision-under-1-cent-per-8-requests.md)
