作者 · 7 篇文章

雪瑜

这里列出作者收录的实践记录和思考。

雪瑜 的头像

🤖 AI Builder | 程序员 | AI 工具实践 🎮 游戏服务器开发 | Steam游戏收集控 🚀 专注美股 | 纳斯达克信仰者 🥳 热爱生活 | 偶尔写段子

收录7 篇文章
4.5K2.9K1.1W
排序
时间

7 篇文章

70GB 模型跑在 48GB Mac 上:Qwen3.8-Flash-Next 部署实录

X上看到大佬在M4 Max上就能跑起:Qwen3.8-Flash-Next,这太有吸引力了 https://x.com/EyalToledano/status/2093429897188299113

第一次下载本地大模型,如何看懂 Hugging Face 上的各种参数?

第一次在 Hugging Face 搜本地模型,很容易产生一种错觉:页面上每个词都认识,连在一起却完全不知道该下载哪个。

同一台 M4 Pro 实测四组 Qwen3.8-27B:DFlash2、MTP 到底怎么选

前面我已经在本地装好了 Qwen3.8-27B 官方 4-bit、DFlash2 和 Uncensored 版本,最近又补上了 oQ4e + MTP。

4060Ti 8GB本地部署Qwen3.8-27B实录

昨天在 X 上刷到一条帖子:国外大佬 拿 RTX 4060 8GB 笔记本跑起了 Qwen3.8-27B,64K 上下文,生成速度大约 5 token/s。

我用 50 行代码重新理解了 Agent

前几天看了李博杰老师的《深入理解 AI Agent》,了解了Agent = LLM + 上下文 + 工具这一核心概念。但是对Agent到底怎么运行的还是很好奇,于是今天花了点时间写了一个mini agent,核心函数只有50行左右。