Strata official homepage preview

AI 助手与 Agent

Strata - Local LLM

在自己的游戏电脑上免费离线运行 1250 亿参数大模型。

分类
AI 助手与 Agent
开发团队
Niko1221 (open source)
来源
github.com
最近更新
2026-10-01
在 GitHub 查看

产品洞察

快速了解 Strata

价值主张

在消费级硬件上获得接近服务器级的大模型能力,不按 token 付费。

解决的问题

这种规模的模型通常需要数据中心级显卡或付费云端 API。

适合人群

拥有 12 GB 以上显卡和 32 GB 以上内存、想要私有本地大模型的玩家和开发者。

价格与访问方式

免费开源(MIT 协议)。只需自备硬件和约 80 GB 磁盘空间。

市场标签

  • 本地 AI
  • 开源大模型工具

技术栈

  • Qwen3.8-Flash-Next(1250 亿参数 MoE)
  • 显卡 + 内存 + SSD 分层加载
  • 兼容 OpenAI 与 Anthropic 的 API

Strata 是什么?

Strata 就是大家搜索“Strata LLM”时通常指的项目:一个本地大模型引擎和应用,可在 Windows 或 Linux 游戏电脑上运行 1250 亿参数的 Qwen3.8-Flash-Next。最常用的专家留在显卡上,其余放在内存里,查找表存放在固态硬盘。在 RTX 5070 上,根据模型大小每秒可生成约 50 到 95 个 token。它能聊天、写代码、看图,还能接入编程 Agent,全程离线。

如何使用 Strata

  1. 01

    下载并运行安装程序

    从 GitHub 下载 Strata,Windows 双击 START-HERE.bat,Linux 运行 ./setup.sh。

  2. 02

    选择模型大小

    安装程序会检测显卡和内存并推荐合适的大小,然后一次性下载约 70 GB。

  3. 03

    聊天或接入应用

    打开 http://127.0.0.1:8080 聊天,或把兼容 OpenAI 的应用指向 http://127.0.0.1:8080/v1。

Strata 的核心功能

  • 12 GB 显卡运行 1250 亿参数模型
  • 浏览器聊天和实时硬件监控
  • 兼容 OpenAI 与 Anthropic 的本地 API
  • 支持 NVIDIA 与 AMD、Windows 与 Linux

Strata 适合什么场景?

  • 私密聊天和文档处理
  • 给编程 Agent 当免费后端
  • 在家体验前沿级开源模型

关于 Strata 的常见问题

Strata LLM 是什么?

通常指 Strata,一个 GitHub 上的开源应用,能在消费级游戏电脑上运行 1250 亿参数的 Qwen3.8-Flash-Next。这个名字也被一些无关的研究项目使用,比如一篇上下文缓存论文。

需要什么硬件?

需要 12 GB 以上显存的 NVIDIA RTX 20–50 系列或较新的 AMD Radeon 显卡,至少 32 GB 内存(64 GB 可运行所有尺寸),以及约 80 GB 固态硬盘空间。

Strata 免费吗?

免费。它采用 MIT 开源协议,完全在你的电脑上运行,没有按 token 收费。

Strata 和 LM Studio 有什么不同?

LM Studio 可运行多种适合你电脑的开源模型;Strata 专注于一个超大模型,通过把它拆分到显卡、内存和固态硬盘上,让游戏电脑也能跑起来。

官方网站快照

github.com

Strata(常被搜索为“Strata LLM”)是一款免费开源应用,能在配有 12 GB NVIDIA 或 AMD 显卡的普通游戏电脑上运行 1250 亿参数的 Qwen3.8-Flash-Next。它把模型分摊到显卡、内存和固态硬盘上,并提供浏览器聊天界面和兼容 OpenAI 的本地 API。