大小:57.09 MB
语言:简体中文系统:Android
类别:系统工具时间:2026-08-22
雨晴LLM是一款专为Android移动端打造的本地离线大语言模型推理服务器,主打手机端本地化AI部署能力,彻底打破传统大模型依赖电脑设备与网络环境的局限。作为轻量化的移动端推理工具,软件无需依托云端服务器,全程脱离网络即可独立运行大模型推理任务,有效保护用户数据隐私,避免联网推理带来的信息泄露、延迟过高、网络受限等各类问题。它大幅降低了普通安卓设备部署大模型的操作门槛,无需搭建复杂编译环境,无需专业技术基础,普通用户也能轻松在手机端部署运行离线大模型,让移动端本地AI推理变得简单高效。
雨晴LLM软件搭载完善且实用的核心功能,推理运行灵活可控,适配不同设备与使用需求。雨晴LLM支持CPU与GPU双推理后端自由切换,用户可根据手机设备性能、运行场景自主选择推理模式,兼顾运行稳定性与推理效率,低配设备可用CPU平稳运行,高配设备可切换GPU实现高速推理。同时软件内置实时性能统计仪表板,能够直观展示设备显存占用、推理速度、运行负载等核心数据,让AI推理运行状态可视化,方便用户实时监控设备运行情况,及时调整参数优化运行效果。
1、支持CPU、GPU两种推理后端自由切换,可根据手机硬件配置、功耗需求自主选择,兼顾老旧设备兼容与高性能机型加速场景。
2、内置NanoHTTPd网络服务,在本机开放兼容OpenAI规范的API端点,各类聊天前端、自动化工具、脚本程序均可直接接入。
3、配备实时统计仪表板,可视化展示推理速度、内存占用、负载状态等运行数据,方便用户监控模型运行状态及时调整参数。
4、支持持久后台服务模式,启动推理服务后可切至后台持续运行,不会因页面退出中断推理任务,稳定为外部客户端提供AI接口。
1、模型采用独立下载机制,用户按需获取对应量化规格的Gemma权重文件导入,不强制捆绑内置模型,灵活平衡存储空间与推理效果。
2、完整兼容标准OpenAI对话接口格式,支持多轮对话上下文、参数自定义,几乎无需修改代码即可将云端AI程序迁移至手机本地离线运行。
3、提供可拖动悬浮窗口,无需常驻应用主界面,在任意界面快速启停服务、切换模型、查看运行日志,多任务并行操作更便捷高效。
4、提供基础推理参数自定义选项,可调整温度、上下文长度、最大生成长度等配置,适配创意写作、逻辑推理、代码生成等不同任务需求。
1、安装APK,授予存储、后台悬浮窗、后台运行权限。
2、进入模型管理页面,下载对应Gemma量化模型文件。
3、选择CPU/GPU推理后端,启动本地API服务。
4、使用任意兼容OpenAIAPI的客户端,填写本地地址`//127.0.0.1:8080`即可调用。
5、悬浮窗可随时查看生成进度、切换模型、关闭服务。
相关文章更多攻略>>
相关合集
隐私保护软件
隐私保护软件
更多+下载排行