ESP32-AI亮相:8MB PSRAM运行2890万参数模型
作者:EasyWind
时间:2026-07-28
浏览:0
乌克兰开发者成功在ESP32-S3上运行2890万参数AI模型,通过分层嵌入与4-bit量化将模型压缩至14.9MB,嵌入表存入闪存缓解内存压力,适用于离线咖啡机等垂直场景,验证了小芯片运行大模型的可能性。
在嵌入式AI领域,一个看似不可能的任务最近被实现了:乌克兰开发者Sla va S成功在乐鑫ESP32-S3开发板上跑通了2890万个参数的本地AI模型。要知道,这块开发板的内存资源相当有限——512KB的SRAM、8MB的PSRAM和16MB的闪存。此前,另一位开发者Da ve Bennett在这块板子上部署AI模型时,参数上限被卡在26万个。差距有多大?整整两个数量级。
那么,Sla va S是怎么做到的?关键一招是采用了Google Gemma模型中的“Per-Layer Embeddings”(分层嵌入)技术。模型经过4-bit量化后,文件大小被压缩到14.9MB,而25M参数的嵌入表被直接存入16MB的闪存中。这样一来,模型每生成一个Token,只需要从嵌入表中读取少量数据,内存压力大幅降低。

当然,得说清楚:这块板子虽然能跑2890万个参数,但别指望它陪你聊天或写代码。Sla va S本人也坦承,目前的应用场景更偏向于垂直领域——比如离线咖啡机。想象一下,一台搭载ESP32-S3的咖啡机,可以根据咖啡豆品种、研磨方式、水粉配比和水温,实时生成个性化的冲泡建议。这比云端方案更省心,也更有趣。

话说回来,这个突破的意义更多在于验证了“小芯片也能跑大模型”的可能性。当算力成本不再是唯一瓶颈,嵌入式AI的边界正在被重新定义。
作者最新文章
淘宝闪购“等灯不计时”机制解析:政策、技术与多方协同
2026-09-08 18:00
一加自研电竞三芯P4/G3/T3确认:一加16首发,支持185FPS及9000mAh电池
2026-09-08 16:52
抖音拍摄剪辑教程:从竖屏运镜到卡点成片
2026-09-03 06:05
Excel筛选大于指定数值:操作步骤与结果验证
2026-09-03 06:03
PDF添加文字水印:位置、透明度与字号设置指南
2026-09-03 06:01
热门文章
更多
精品专题
更多
Mac软件
更多
WINDOWS
更多

































