当前位置:首页>应用下载>雨晴LLM下载_雨晴LLM手机版下载 v1.0.0安卓版
雨晴LLM下载_雨晴LLM手机版下载 v1.0.0安卓版

雨晴LLM下载_雨晴LLM手机版下载 v1.0.0安卓版

实用工具 · 57.09MB

更新日期:2026-08-19
6.0

安全下载 · 资源已校验

应用截图
应用介绍

雨晴LLM是专为安卓手机打造的本地离线大语言模型推理服务器,无需联网即可运行。该工具大幅降低安卓设备本地部署大模型的门槛,无需复杂编译环境,启动服务后,任意支持OpenAI接口的客户端均可直接接入手机端离线Gemma模型。常驻后台服务搭配悬浮操控窗口,用户可以一边运行推理服务,一边切换其他应用,随时查看显存占用、推理速度等实时指标。支持CPU与GPU后端自由切换,内置实时性能监控仪表盘,配备可拖拽悬浮控制窗,并具备持久化后台服务能力。用户需自行下载并导入模型文件,灵活适配各类参数量级的开源权重。

雨晴LLM宣传图

应用特色

1、提供基础推理参数自定义选项,可调整温度、上下文长度、最大生成长度等配置,适配创意写作、逻辑推理、代码生成等不同任务需求。

2、优化移动端资源调度策略,后台推理时管控功耗与内存占用,减少长时间运行出现卡顿、闪退问题,延长离线推理任务持续运行时长。

3、支持多客户端同时接入本地API服务,局域网内其他设备也可访问推理接口,实现手机作为家庭离线AI中枢,供多终端调用大模型能力。

4、支持CPU、GPU两种推理后端自由切换,可根据手机硬件配置、功耗需求自主选择,兼顾老旧设备兼容性与高性能机型加速推理的使用场景。

5、内置NanoHTTPd网络服务,在本机开放兼容OpenAI规范的API端点,各类聊天前端、自动化工具、脚本程序均可直接接入,轻松对接成熟的AI软件生态。

6、配备实时统计仪表板,可视化展示推理速度、内存占用、负载状态等运行数据,方便用户监控模型运行状态,及时调整参数优化推理表现。

雨晴LLM怎么使用

1、安装APK,授予存储、后台悬浮窗、后台运行权限;

雨晴LLM怎么使用配图1

2、进入模型管理页面,下载对应Gemma量化模型文件;

3、选择CPU/GPU推理后端,启动本地API服务;

怎么使用配图2

4、使用任意兼容OpenAIAPI的客户端,填写本地地址`//127.0.0.1:8080`即可调用;

5、悬浮窗可随时查看生成进度、切换模型、关闭服务。

应用优势

支持持久后台服务模式,启动推理服务后可切至后台持续运行,不会因页面退出中断推理任务,稳定为外部客户端持续提供AI接口服务。

模型采用独立下载机制,用户按需获取对应量化规格的Gemma权重文件导入,不强制捆绑内置模型,灵活平衡存储空间与推理效果。

完整兼容标准OpenAI对话接口格式,支持多轮对话上下文、参数自定义,几乎无需修改代码,即可将原有云端AI程序迁移至手机本地离线运行。

提供可拖动悬浮窗口,无需常驻应用主界面,在任意界面快速启停服务、切换模型、查看运行日志,多任务并行操作更加便捷高效。

版本更新
更新评分:6.0 分 · 57.09MB
更新日期:2026-08-19
评分
6.0综合评分
5星
1星推荐
5
--
4
--
3
--
2
--
1
当前
相关下载