
应用版本v1.17.3 安卓汉化版
应用类别系统工具
应用大小229.0M
更新时间2026-09-16 10:20
应用星级
运行环境Android
官方网址http://www.llm-ventures.com/
应用厂商Asghar Ghorbani
发布版本 v1.17.3 最新的
@github-actions github-actions 发布了此版本 5天前
· 自此版本发布以来,主分支共 提交了 18 次
发生了哪些变化?
声明 ITMS-90683 要求的位置用途字符串@a-ghorbani在第 881 号
由 Hosted Weblate 提供的翻译更新@weblate在第 884 号
@pocketpal-dev-team[bot] 在#902中建议从有效载荷门中移除六边形符号计数触发条件。
将 llama.rn 升级到 0.13.0-rc.3(llama.cpp b10588 -> b10829)@dongjiang1989在第901期
修复:在#907中,由 @pocketpal-dev-team[bot] 发现的 HTP 会话中,选择用于 Hexagon 推理的会话。
@pocketpal-dev-team[bot] 在#909中建议从“关于”页面移除赞助链接。
新贡献者
@pocketpal-dev-team[bot] 在#902中做出了他们的首次贡献
@dongjiang1989他们在#901中首次做出贡献




此内容由AI根据文章内容自动生成,并已由人工审核
PocketPal AI官方正版安卓下载是一款开源的大模型人工智能应用,界面里没有广告,功能也不设付费墙。打开后可以先下载软件提供的模型,也可以自己导入本地模型文件,用来学习生活,或是其他专业领域的开发辅助作用,让你的办事过程更加得心应手,还在为找不到一款合适的AI应用而发愁的用户们,欢迎来这里下载和使用。

口袋里的私人人工智能。PocketPal直接在您的手机上运行开源语言模型。无需网络连接。数据不会离开您的设备。随时随地聊天——飞机上、隧道里,甚至完全脱离网络的地方。


在iOS设备上,Apple的GPU API(Metal) 默认处于激活状态。如果您遇到任何问题,请尝试停用它
iOS金属
自动卸载/加载
为了保持设备平稳运行,PocketPal AI可以自动管理内存使用情况
在模型页面上启用 “Auto Offload/Load” (默认情况下是)
该应用程序将在后台卸载模型
当您返回时,它会重新加载(对于较大的模型,请等待几秒钟)
高级设置
单击V形图标可访问高级LLM设置,例如
温度
BOS代币
聊天模板选项等

加载模型后,前往 “聊天” 页面并开始与加载的模型交谈
此时还会显示generation performance(生成性能) 指标。如果有兴趣,请观察聊天气泡以获取实时性能指标:每秒令牌数和每个令牌的毫秒数

内存不足导致闪退:系统因内存不足会杀死PocketPal进程。可关闭后台其他应用释放内存,或换用参数更小、量化更低的模型(如Q3/IQ3甚至Q2/IQ2)。
模型文件不完整或损坏:重新下载模型文件,确保文件大小与源文件一致,建议通过应用内置的Hugging Face集成直接下载。
应用版本过旧:更新PocketPal至最新版本。开发者在v1.9.2及更高版本中修复了多个模型加载问题,v1.8.4也修复了部分加载故障。
存储空间不足:下载模型前检查手机剩余空间,确保至少有1.5倍于模型大小的可用空间。可删除不常用的大型模型释放空间。
调整运行参数:进入设置→模型设置,减少上下文大小(Context Length),或降低GPU层数量以减轻内存压力。
1、打开PocketPal软件,点击下载模型

2、点击任意模型下方的下载按钮,等待下载完成,即可完成添加

3、点击右下角的+,还可以添加其它的AI大模型

4、模型加载后设置完成后可进入设置界面进行相关设置,设置完成后即可进行诸如随时随地与模特进行私密的离线对话等相关操作

1.打开软件点击Models,点+,点Hugging Face搜索大模型

2.尽量下载名字带Q4_NL(4bit量化 normal 压缩)的模型,回答比较精准。

3.解释一下部分量化标识命名规则:NL平衡精度与速度(Normal)、M中等优化(middle)、 XS极致压缩(Extra Small)、K 极限压缩(K-special)、Qx量化位数(手机上运行Q4最佳)。

4..在加载好模型后在Settings中把N PREDICT设置为4096。
5.之后开始你的AI对话模拟之旅吧。
1、打开PocketPal软件,点击左上角的三横

2、点击setting

3、下滑页面,点击如图所示的English,然后点击中文

4、切换后页面就是中文显示了

PocketPal是一款开源应用,能将大语言模型直接部署在手机上离线运行,无需联网,数据保存在设备本地。
它支持iOS和Android系统,iOS支持Metal加速,Android支持NNAPI加速。
应用本身免费,不预装模型,需要用户自行下载和导入模型文件才能使用。
安装应用:iOS用户在App Store搜索“PocketPal AI”下载。Android用户可在Google Play搜索安装,若无法访问则从GitHub Releases页面下载APK文件(https://github.com/a-ghorbani/pocketpal-ai/releases)。
配置运行环境:运行小型模型需要6GB以上运行内存,运行更高级的模型则需要8GB以上运行内存。近2-3年的旗舰和中端机型均可流畅运行。
下载模型:打开应用后,点击右下角“+”号,可选择“从Hugging Face下载”或“添加本地模型”(需提前将.gguf格式文件存入手机)。
加载与使用:下载完成后返回模型列表,点击模型进行加载即可开始对话。首次加载需要编译,可能需要等待一段时间。
按设备内存选择:运行小型模型需6GB以上运行内存,运行更高级的模型需8GB以上运行内存。旗舰机型(16GB内存)可运行8G以下模型,中端机型(8GB内存)建议选择更小参数或更低量化的模型。
按参数规模选择:模型名称中“0.6B”“1.5B”“3B”等表示参数规模,数字越大能力越强但对内存和算力要求越高。首次尝试建议选择Qwen3-0.6B-GGUF,对6-8GB内存的主流手机较为友好。
按量化方式选择:下载时尽量选择名字带Q4_NL(4bit量化)的版本,回答更精准。内存较小的设备(如3GB RAM)可尝试Q3、IQ3甚至Q2、IQ2等更低量化的版本。
推荐模型参考:Qwen系列(如Qwen2.5-1.5B-Instruct、Qwen2.5-3B-Instruct、Qwen3-4B-GGUF)在PocketPal上兼容性较好。使用DeepSeek-R1系列模型时,建议将temperature设置在0.5-0.7(推荐0.6)的范围内,防止无休止重复或不连贯输出。
| 📦 软件名称 | ⭐ 推荐星级 | ✨ 功能优势 |
| 🦙 Ollama | ★★★★★ 5.0 | 本地运行大模型,命令行操作简洁 |
| 💻 LM Studio | ★★★★★ 5.0 | 桌面端本地模型运行,图形界面友好 |
| 💬 ChatGPT | ★★★★☆ 4.5 | 云端AI助手,问答能力强 |
| 🟢 豆包 | ★★★★☆ 4.5 | 字节旗下AI助手,中文理解好 |
| 📝 文心一言 | ★★★☆☆ 3.5 | 百度AI对话,知识问答覆盖广 |
推荐指数综合用户口碑与实用度评定,仅供参考

scene最新版下载vN1 2026.09 Alpha5 安卓版
系统工具 / 8.4M / 2026-09-11
okk云电脑官方免费下载v1.3.1 手机版
系统工具 / 135.4M / 2026-08-28
ThemeTool安卓版下载v2.0.0 安卓版
系统工具 / 6.2M / 2026-09-06
微思应用商店app官方版下载v3.7.2 最新版
系统工具 / 7.9M / 2026-09-15
灵动岛pro6.5版本官方免费下载v6.5 安卓最新版
系统工具 / 106.7M / 2026-09-14
破皮裤安卓下载(poipiku)v232 最新版
系统工具 / 6.2M / 2026-09-10
小米海外应用商店getapps下载安卓最新版v39.8.5.0 官方正版
系统工具 / 36.9M / 2026-09-05
哔哩终端手表版下载官方正版v2.9.8 安卓版
系统工具 / 9.2M / 2026-08-26
灵动岛Pro解锁版vip版下载v6.4 安卓免费版
系统工具 / 106.7M / 2026-09-14
闪玩app官方正版下载手机版v3.0.3 安卓免费版
系统工具 / 57.5M / 2026-09-02
选择头像: