产业观察

不烧一分云端Token!RTX 3090本地跑Qwen3.8-27B:5小时做出可玩游戏

驱动之家·2026/9/17 03:54:00🔗 原文

📋总体概括

海外用户EcstaticDentist用一张RTX 3090本地运行Qwen3.8-27B的Q4KM量化版本(4-bit量化,文件约16.8GB),在不消耗任何云端Token的情况下,约5小时开发出一款第一人称僵尸射击游戏,游戏文件仅190MB。开发分多轮进行,每轮约一小时,靠提示词驱动、未手动改代码。他分享了让模型自己生成提示词、再用另一对话做记忆追踪的双模型工作流,展示了消费级显卡本地跑大模型做软件开发的可行性。

关键信息

  • 海外用户用一张RTX 3090本地运行Qwen3.8-27B的Q4KM量化版本,全程零云端Token消耗
  • 约5小时做出第一人称僵尸射击游戏,游戏文件仅190MB,未手动修改代码
  • 采用双对话工作流:一个对话生成提示词并充当记忆与进度追踪,另一个模型负责写代码
  • Q4KM为4-bit量化,模型文件约16.8GB,可在24GB显存消费级显卡上运行

🔥犀利点评

真正值得关注的不是5小时做出游戏,而是零Token成本跑通完整开发闭环。云端API按订阅计费的生意,正在被一张二手3090和4-bit量化蚕食底部市场。当然,190MB的小游戏离商业软件还差几个量级,本地27B的代码能力与云端旗舰模型仍有明显差距,这套流程能不能撑住大型工程才是真正的试金石。但对个人开发者来说,生产资料的门槛确实塌了一块。

本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文