登录社区云,与社区用户共同成长
邀请您加入社区
本文介绍了在银河麒麟v10 Server上部署本地大模型RAG服务的实践。系统采用鲲鹏920 CPU和Atlas 300I推理卡,运行Kylin Linux系统,部署了BGE-M3模型实现多语言语义检索,通过Docker容器化部署Ollama和Docling服务。重点解决了离线环境下文档解析和知识库构建问题:使用BGE-M3进行语义嵌入,支持跨语言检索;通过Docling将PDF等非结构化文档转换
本文记录了在银河麒麟v10 Server系统上部署大模型过程中遇到的典型问题及解决方案。作者作为计算机专业毕业生但缺乏web开发经验,详细描述了系统调校、网络配置和软件安装的完整排障过程。主要问题包括:1) OpenWebUI的500错误最终发现是浏览器适配性问题;2) USB网络共享连接失败通过检查RNDIS模式和网络配置解决;3) 通过docker日志分析后端服务连接问题。文章以自嘲口吻记录了
本文记录了一次在鲲鹏+Atlas 300I Duo 推理卡上部署多模态大模型的折腾过程。从成功部署 Qwen2.5-VL-32B 并调参,到尝鲜 Qwen3-VL 时遇到固件不兼容、FP8 量化不支持等一系列踩坑,最终以 vLLM-Ascend 跑通 Qwen3-VL-2B 但仍需回退到 32B 模型收尾,算是一篇既真实又带着“咸淡”的实战日志。
银河麒麟v10 Server部署多模态模型实践 本文介绍了在银河麒麟v10 Server系统上部署Qwen2.5-VL-3B多模态模型的过程。系统采用华为鲲鹏920处理器(aarch64架构)和Kylin Linux Advanced Server V10操作系统,面临的主要挑战包括: 系统适配性问题:国产系统软件源匮乏,依赖库版本较旧 模型下载方案尝试: 通过ModelScope下载时遇到Pyt
摘要:代码主要做的是配电网中产消者点对点交易相关研究,配网中的卖方和买方通过P2P交易匹配协商来平衡供需,同时重点考虑了P2P交易过程中公共设施的使用以及过网费用的分配问题,并等效将其叠加到P2P交易成本上,从而影响P2P交易的定价,模型采用的是交替方向乘子法ADMM法进行求解,能够很好的包含隐私,测试系统为IEEE 39节点系统,通过对配电网进行分区,研究各分区间、各分区内部的P2P交易形式,整
在我频繁使用windowsPC,X86虚拟机Ubuntu和开发板arm64的Linux系统的过程中,我发现文件传输极其麻烦,当我需要调试一个c语言程序的时候,需要将开发板系统生成的core文件多次拷贝到虚拟机系统中进行调试。另外,当需要下载一些模型文件的时候,开发板的网速往往不够,下载速度缓慢。在询问AI后,我得到了可以使用VMware共享文件夹和NFS共享文件目录的方法,让这三个不同环境的设备都
labview调用halcon实现目标检测-obb,源码,labview2018 64位,halcon22.05,里面包含模型和测视集最近在搞目标检测相关项目,发现LabVIEW调用Halcon实现目标检测 - OBB(Oriented Bounding Box,定向边界框)这个组合挺有意思,今天就来跟大家分享一下具体实现过程。咱们用的是LabVIEW 2018 64位版本,搭配Halcon 22
Google、OpenAI 都曾试图在 Gemini 或者 ChatGPT 中尝试接入 AI 打车服务,但因为种种限制,最终实现结果不过是在 AI 助手中唤起了 Uber App——你甚至可以简单理解为内嵌在 AI 助手中的小程序——称不上是真正的 AI 办事。移动互联网过去数十年的发展,彻底重构了人们的生活。你用千问买完电影票,订好机票酒店,再用千问打辆车去往目的地,结束后再预约一个返程车辆,顺
VecGlypher项目配置修改指南摘要(149字) 核心修改分为训练配置和FSDP加速配置两部分。训练配置中必须修改模型路径、输出目录和BF16设置,按需调整worker数量、训练轮次等参数。FSDP配置需根据GPU数量修改进程数,并适配混合精度模式。纯CPU运行时需关闭BF16、指定设备类型,并建议忽略FSDP文件。单GPU需设置NO_SHARD策略,多GPU保持FULL_SHARD。所有路径
本文深入解析OpenClaw中pairing.json与allowFrom两种访问控制机制的本质区别。核心结论是:allowFrom作为网关级配置,在启动时即加载生效,具有稳定可靠的权限控制能力;而pairing.json属于插件私有实现,其读取和生效完全依赖插件自身逻辑,在飞书插件中仅作为通知机制存在。文章从架构层级、存储位置、加载时机三个维度对比两者的差异,并通过源码分析指出pairing机制