项目起源
我想在手机上跑一下小模型,然后跑了一个7b的模型。一轮对话手机发烫,二轮对话直接闪退。
然后试着跑更小的模型,也就是混元的0.5B模型,使用PocketPal软件。
结果对话窗口,一直没有任何回复,重开了几次对话,都是这样。我以为是PocketPal不兼容最近的混元0.5B模型,然后产生了这个App。
但drama的是,两天后我看PocketPal,对话记录里有hunyuan的模型回复,看起来确实是对混元模型兼容有问题,但至少是有记录的。
项目介绍地址
ModelMini · 把大模型装进口袋 | ZTechTools
介绍是AI写的,有点夸大,简单来讲端侧模型可用性,几乎没有,但可以当个玩具玩一下。
速度响应还挺快的,速度基本没有低于10token/s的,一般在15左右,而且简单对话只会微微发烫,但是智能程度,堪称复读机。
我认为的特点功能
内置模型商城:魔搭和Hugging Face,一键搜索下载
Skill:模型智能程度太低,没有可用性
MCP:更是drama
执行Shell命令&对接Termux:测试了三个模型,只有一个模型,调用成功过,也就是Qwen3-0.6B-Q4_K_M
本来想的,如果效果ok的话,就可用直接手机操作termux,再反向代理,实现最简单顺手无门槛的手机当服务器。
还可以支持文生图、文生视频,再release windows与mac版本。
但是确实模型效果太差了,而且手机的配置(24+6 / 1T / 天玑 9300 + 八核 ),也就那样,确实不能期望太多。
一共测试了三个模型(q4_k_m),在此排个序
响应速度:混元0.5B > 千问2.5 0.5B > Qwen3 0.6B
智能程度:Qwen3 0.6B > 千问2.5 0.5B > 混元0.5B
如果感兴趣,可以去我的仓库 UokyI/modelmini: 一个在移动端运行端侧模型的应用,或者我的个人网站里下载APK试一下。
项目首页预览(iframe 内嵌展示第一页)