精品下载站:打造最安全最新的免费软件下载站!
您的位置:首页安卓软件社交聊天 → MNN Chat手机大模型 v0.7.5 官方版
MNN Chat手机大模型图标

MNN Chat手机大模型v0.7.5 官方版

  • 大小:37.0M
  • 时间:2026-09-10 03:33
  • 星级:
  • 语言:中文
  • 环境:Android
  • 版本:v0.7.5 官方版
  • 类别:国产软件/ 免费软件
  • 官网:https://www.mnn.zone/m/0.3/
  • 厂商:
  • 包名:com.alibaba.mnnllm.android

超火deepseek全套教程以及本地部署文件,大模型下载地址:https://pan.quark.cn/s/f2b7513fdb75

软件介绍 软件截图 相关下载 相关文章 评论(1)

精品下载精心为您推荐:

编辑点评:想在手机上跑大模型?MNN Chat绝对是老牌硬核之选。它支持DeepSeek R1满血版、通义QWQ等主流模型本地部署,无需联网也能畅聊。新版重点优化了端侧推理效率,内存占用更低,中低端机型也能实现秒级响应和多轮流畅对话。不仅意图识别更精准,还新增个性化语气调节和离

MNN Chat手机大模型是一个使用手机跑本地大模型的软件,简单来说就是将AI部署在本地手机中,只要下载相应的大模型内容,然后导入,就可以在手机上使用各大厂商的大模型,包含deepseek R1满血版,通义QWQ等,这是一款老牌AI推理引擎工具。

MNN Chat手机大模型最新动态

MNN Chat近期迎来显著升级,核心聚焦于推理效率与多模态支持的深度优化。新版本大幅降低了端侧运行延迟,在主流安卓设备上实现了更流畅的实时对话体验,同时增强了对长上下文窗口的处理能力,确保复杂任务中的记忆连贯性。在多模态方面,图像识别精度得到提升,支持更丰富的视觉问答场景。用户反馈显示,新版界面交互更加直观,资源占用率较之前版本降低约15%,尤其在低端机型上的兼容性改善备受好评。此外,团队修复了若干偶发的内存泄漏问题,并优化了模型加载速度,使得冷启动时间缩短至秒级。未来将继续深耕轻量化技术,致力于让高性能大模型在更多移动终端上普惠可用。

MNN Chat手机大模型最新动态

MNN Chat手机大模型迎来新一轮体验升级,重点优化了端侧推理效率与对话流畅度。新版引擎大幅降低内存占用,让中低端机型也能享受更快的首字响应与更长的多轮对话支持。同时,针对用户反馈的复杂指令理解偏差问题,团队强化了意图识别与上下文关联能力,使日常问答、摘要生成等场景表现更精准自然。此外,离线模式下的知识库覆盖范围进一步扩大,并新增个性化语气调节功能,满足不同用户的表达偏好。官方还根据社区建议优化了界面交互细节,如对话历史分类检索与快捷清除,整体操作更顺手。目前,该版本已在主流应用商店开放下载,欢迎体验并持续反馈,共同推动端侧大模型体验的不断完善。

MNN Chat手机大模型最新动态

MNN Chat v0.7.5官方版正式发布!本次更新聚焦性能优化与交互体验升级:模型推理速度提升30%,内存占用降低15%,端侧运行更流畅;新增“离线语音输入”和“多轮对话上下文记忆增强”功能,回复更精准连贯。用户反馈中,“响应快、省电”获高频好评,同时修复了部分机型闪退与乱码问题。未来将持续推动端侧AI轻量化,让大模型更贴近日常使用场景。

MNN Chat手机大模型

MNN Chat手机大模型怎么使用

1、在本站下载MNN Chat手机大模型;

2、进入软件后,我们需要挑选我们想要部署的AI;

MNN Chat手机大模型

3、注意,这个本地部署至少要保留10GB以上的手机内存;

MNN Chat手机大模型

4、下载完成以后,就可以通过此软件与AI进行对话与聊天了;

MNN Chat手机大模型

5、支持多个语言,无限制词聊天,本地部署无需联网即可使用。

MNN Chat手机大模型

详细使用攻略可看文档:https://mnn-docs.readthedocs.io/en/latest/transformers/llm.html

MNN Chat是什么软件

MNN是一个轻量级的深度神经网络引擎,支持深度学习的推理与训练。适用于服务器/个人电脑/手机/嵌入式各类设备。目前,MNN已经在阿里巴巴的手机淘宝、手机天猫、优酷等30多个App中使用,覆盖直播、短视频、搜索推荐、商品图像搜索、互动营销、权益发放、安全风控等场景。

MNN-LLM是基于MNN引擎开发的大语言模型运行方案,解决大语言模型在本地设备的高效部署问题(手机/个人电脑/嵌入式设备)。支持常见的千问/百川/智谱/LLAMA等大语言模型。

软件功能

主体功能(模型推理CPU+GPU)无任何依赖,代码精简,可以方便地部署到移动设备和各种嵌入式设备中。

iOS平台:功能全开的MNN静态库 armv7+arm64大小12MB左右,链接生成可执行文件增加大小2M左右。可裁剪主体功能后静态库大小6.1M ,链接生成可执行文件增加大小 600 KB。

Android平台:主体功能 armv7a - c++_shared 动态库大小800KB左右。

支持采用 Mini 编辑选项进一步降低包大小,大约能在上述库体积基础上进一步降低 25% 左右。

支持模型FP16/Int8压缩与量化,可减少模型50% - 75% 的体积

通用性

支持 Tensorflow、Caffe、ONNX、Torchscripts 等主流模型文件格式,支持CNN / RNN / GAN / Transformer 等主流网络结构。

支持多输入多输出,支持任意维度的输入输出,支持动态输入(输入大小可变),支持带控制流的模型

算子丰富,支持 178 个Tensorflow Op、52个 Caffe Op、163个 Torchscipts Op、158 个 ONNX Op(ONNX 基本完整支持)

支持 服务器 / 个人电脑 / 手机 及具有POSIX接口的嵌入式设备,支持使用设备的 CPU / GPU 计算,支持部分设备的 NPU 计算(IOS 11 + CoreML / Huawei + HIAI / Android + NNAPI)

支持 Windows / iOS 8.0+ / Android 4.3+ / Linux  及具有POSIX接口的操作系统

软件亮点

对iOS / Android / PC / Server 的CPU架构进行了适配,编写SIMD代码或手写汇编以实现核心运算,充分发挥 CPU的算力,单线程下运行常见CV模型接近设备算力峰值

支持基于 Metal / OpenCL / Vulkan 使用移动端设备上的GPU进行推理

支持基于 CUDA 使用 PC / Server 上的 NVIDIA GPU 实现更快速的推理

广泛运用了 Winograd 卷积算法提升卷积性能,首次在业界工程实践中实现转置卷积的Winograd算法优化与矩阵乘的Strassen算法优化,并取得加速效果

支持低精度计算( int8 / fp16 / bf16)以提升推理性能。并对 ARMv8.2 和 AVX512架构的相关指令进行了适配,这两种架构下有更好的加速效果

支持使用 MNN 的算子进行常用的数值计算,覆盖 numpy 常用功能

提供 MNN CV 模块,支持图像仿射变换与归一化等 MNN_CV 库,支持常用的图像处理(armv7a 架构下小于 100 k )

支持各平台下的模型训练,尤其是移动端上的模型训练

支持 python 调用

更新日志

0.3.0

LLM 相关更新

App 发布

Android

新增Android的大模型应用(LLM / Diffusion),详见 apps/Android/MnnLlmChat/README.md

iOS

新增 iOS 的大模型应用,详见 apps/iOS/MNNLLMChat/README.md

新特性

模型支持

支持 Qwen2-VL / Qwen2-Audio / Qwen2.5-VL 等多模态大模型的导出和运行。

支持 DeepSeek-R1-1.5B-Qwen 和 DeepSeek-R1-7B-Qwen

LLM 单步执行支持

新增了对 LLM 单步执行的支持,便于调试和优化模型推理过程。

LLM 扩展采样算法支持

扩展了采样算法的支持,提升了模型推理的灵活性和多样性。

LLM 导出模型时支持输出历史 Token 的概率值

在导出 LLM 模型时,新增了输出历史 Token 概率值的功能,便于后续分析和优化。

LLM-CPU 支持 mmap 文件缓存

新增了对 mmap 文件缓存的支持,使二次加载模型时避免内存重排,提升了加载效率。

性能优化

CPU 多线程性能进一步提升

对 LLM 多线程性能进行了优化,进一步提升了整体推理速度。

CPU prefill 性能优化

优化了 CPU 上 prefill 性能,使 1024 token 输入和 512 token 输入的 prefill 性能持平。

GPU 优化 OpenCL AutoTuning 耗时

优化了 OpenCL AutoTuning 的耗时,避免了首次推理耗时过长的问题。

GPU 优化:Metal / OpenCL 支持 fp16 的 scale/bias,支持对称量化优化

Metal / OpenCL 后端支持 fp16 的 scale/bias 和对称量化优化的支持,提升了推理效率。

LLM 加速:Metal / OpenCL 后端支持 scale/bias 使用 fp16

Metal / OpenCL 支持 scale/bias 使用 fp16(设置 precision = low 时启用),进一步优化了 GPU 推理性能。

小编推荐同类软件

  • 豆包:字节跳动出品,多场景AI助手
  • 文心一言:百度大模型,中文理解强
  • 通义千问:阿里旗下,功能全面
  • Kimi:长文本处理,效率极高
  • 智谱清言:清华团队,技术领先
  • 讯飞星火:语音交互,本地优化好
  • ChatGPT:全球通用,对话自然流畅

MNN Chat手机大模型截图

MNN Chat手机大模型截图
MNN Chat手机大模型截图
MNN Chat手机大模型截图
MNN Chat手机大模型截图
MNN Chat手机大模型截图
下载地址

网友评论

热门评论

最新评论

江苏南通 网友 2026/6/25 21:42:53
界面设计合理,内容丰富,挺好用的

Samsung_Galaxy_S25_Ultra支持( 0 ) 盖楼(回复)

发表评论查看所有评论(1)

昵称:
表情: 高兴 可 汗 我不要 害羞 好 送花 亲亲
字数: 0/500 (您的评论需要经过审核才能显示)

TOP榜