一个盒子搞定专属小模型:祥承端侧 AI 重构干行百业现场生产力
2026 年 6 月 10 日,祥承科技在上海总部正式发布重磅端侧 AI 产品 ——AngelToken·DIY 算力底座。这款巴掌大小的设备以 "蒸馏 + 微调,做你自己的小模型" 为核心定位,直击通用大模型落地过程中 "不够准、费用高、数据不安全" 三大行业痛点,为千行百业提供了一套低成本、高可靠、数据不出门的端侧 AI 解决方案,标志着物理 AI 从概念验证正式进入规模化普惠落地的新阶段。

大模型落地的 "不可能三角" 亟待破解
当前,人工智能产业正加速从 "云端智能" 向 "现场智能" 转型。云端大模型虽然具备强大的通用能力,但在落地到零售、仓储、制造等真实物理场景时,始终面临着难以逾越的 "不可能三角":想要模型精准,就需要昂贵的硬件投入;想要控制成本,就不得不牺牲模型效果;而将核心业务数据交给第三方训练,又存在巨大的隐私与合规风险。
祥承科技创始人团队指出,云端 AI 就像一个绝顶聪明的大脑,能想、能算、能决策,却被锁在数据中心,碰不到真实的物理现场 —— 听不到收银台前顾客犹豫的语气,看不到第三排货架正在悄悄变空,走不到拣货员身边说一句 "顺路带过去",也做不到在系统里补录一条漏掉的入库单。这不是技术瓶颈,而是物理定律。
更关键的是,将端侧 AI 简单等同于 "把云端模型塞进盒子里" 是一个巨大的误区。端侧 AI 的真正难点在于把科学问题变成工程问题,再把工程问题压进物理极限里:要在仅为云端几十分之一的功耗内做多模态实时推理;要在豪秒级完成 3-5 个模型的算力调度;要在量化压缩的同时保证识别精度;要在共享算力上实现硬实时确定性;还要解决感知自纠正、部署后劣化等一系列工程陷阱。这些都是没有十几年硬件积累根本无法完成的 "脏活累活"。
AngelToken·DIY:一个盒子搞定专属小模型
针对上述行业痛点,祥承科技历时多年研发推出的 AngelToken·DIY 端侧算力底座,通过 "微调 + 蒸馏" 双引擎技术,完美破解了大模型落地的 "不可能三角"。
在硬件配置上,标准版 AngelToken·DIY 搭载 48 TOPS INT8 专用 APU,配备 8 核 CPU、12GB 内存与 512GB 存储,运行 Android 15 操作系统,支持 Wi-Fi 7、USB-C、HDMI、RJ45 等丰富接口。设备采用风扇 + TEC 双重主动散热设计,具备 IP5X 防护等级,可在 - 20℃至 + 50℃的宽温环境下 7×24 小时满频稳定运行,完全满足工业级应用需求。针对高算力场景,祥承还提供 AngelToken Max(100Tops INT8) 和 AngelToken Ultra(400 Tops NVFP4)两款升级型号,实现算力梯度覆盖,适配不同负载需求。
微调技术解决 "准" 的问题。企业可以用自身的业务数据对通用大模型进行微调,让模型熟悉企业的商品、工艺、规则与行话,变成专属于企业的 "技术专家"。对于没有训练数据的企业,祥承科技还提供专业的数据生成服务,确保模型效果达到业务要求
蒸馏技术解决 "用得起" 的问题。通过先进的模型蒸馏技术,祥承能够将百亿参数大模型的核心能力迁移到小模型上,让小模型也能干大模型的活,同时大幅降低硬件配置要求。原本需要数万 GPU 服务器才能运行的任务,现在在几千块的 AngelToken·DIY 盒子上就能流畅运行。
整个模型部署流程清晰可控:首先明确业务任务并准备数据,然后由祥承专业团队完成微调与蒸馏,模型经测试后上架 Model Store,最后通过设备 SN 号精准下发到指定的 AngelToken 设备上。更重要的是,模型上线后并非一成不变,而是会结合真实业务场景中的 bad case 进行持续自净化,低置信度结果自动送云端复核并回传调优,实现 "越用越准"。
在模型兼容性方面,AngelToken·DIY 已全面适配主流开源模型生态,包括 Qwen2.5/3、Llama3、Gemma 4 等大语言模型,Qwen3-VL等多模态模型,SenseVoice、Qwen3-ASR 等语音识别模型,以及 YOLO 系列、Mobile Sam 等视觉推理模型。内部实测数据显示,Qwen3 8B 模型在 AngelToken·DIY 上的 Decode 速度可达 11.6 tok/s,完全满足企业级实时推理需求。未来,新模型将通过 Model Store OTA 推送,实现 "硬件不变,能力常新"。
为用户创造实实在在的核心价值
AngelToken·DIY 的发布,为不同类型的用户带来了革命性的价值体验,真正实现了 AI 技术的普惠化。
对于企业而言,AngelToken·DIY 大幅降低了 AI 应用的门槛与成本。过去需要投入数十万资金、组建专业算法团队、耗时数月才能完成的 AI 系统建设,现在只需几千元购买设备,提出业务需求,两周内就能拥有专属的 AI 模型。这使得广大中小企业也能享受到 AI 技术带来的效率提升,在市场竞争中获得平等的机会。
对于数据敏感型企业而言,AngelToken·DIY 彻底解决了数据安全的后顾之忧。所有的模型训练与推理过程都在本地设备上完成,数据 100% 不出企业大门,通过 Wireshark 抓包可验证零外部请求。这对于零售、制造、金融等对数据隐私要求极高的行业来说,是不可替代的核心优势。同时,端侧部署也完美解决了物理现场网络不稳、实时响应要求高、云端传输成本高昂等共性难题。
对于行业 ISV 与集成商而言,AngelToken·DIY 提供了一个标准化、可复用的算力底座。合作伙伴无需再从零搭建底层算力与硬件平台,只需专注于自身擅长的行业 know-how 与业务逻辑开发,就能快速打造出垂直行业的 AI 解决方案。祥承科技 "你出脑子,我出身体" 的开放合作模式,让合作伙伴能够以最低的成本、最快的速度推出差异化产品。
对于现场工作者而言,基于 AngelToken.DIY 构建的 AI 系统始终坚持 "赋能而非管控" 的原则。如果工作者觉得被监控,他就不用;不用,系统就是废铁。所以祥承把「科技至善」做成产品里的默认与能力,但怎么用、给谁看,选择权在你。
构建完整的物理AI生态体系
AngelToken·DIY 并非一个孤立的产品,而是祥承科技 FieldIntelligence 物理 AI 基础设施的核心算力底座。FieldIntelligence 是一个四层一体、按需组合的完整产品家族,覆盖从底层算力到上层硬件的全栈能力,企业可根据自身场景灵活选型组合,无需从零搭建。
其四层架构分别为:AngelToken 算力底座,提供端侧即时算力,可单独售卖;AngelClaw 运行时底座,随硬件配套,包含 AngelNow 会话上下文能力;AngelWeave A2A 平台,实现多智能体间的高效协作,可单独售卖;AngelDevice 感知与执行硬件,涵盖 AngelTalk 对话、AngelSeen 视觉、AngelWhere 位置、AngelStatistic 数据四大感知智能体,以及 AngelAssistant 对人、AngelHaul 对物、AngelControl 对系统三类执行硬件。每款硬件均有多形态、多算力配置,按场景选型组合。
目前,基于 FieldIntelligence 体系,祥承科技已在零售、仓储、制造等多个行业打造了成熟的样板场景:Linkii + 导购员的 AI 搭档可在高峰期分担基础接待工作;Aimgo 自助收银的 AI 辅助能有效降低漏扫率;Leapfrog 仓库的神经反射弧大幅减少拣货员无效走动;OnePoint 工人的 AI 工作搭档为一线员工提供随时支援。
业内人士表示,AngelToken·DIY 的正式发布,填补了端侧 AI 普惠化的市场空白,为物理 AI 的规模化落地铺平了道路。随着端侧算力的不断提升与模型技术的持续进步,AI 将真正从云端走向现场,融入千行百业的每一个角落,成为推动实体经济高质量发展的核心动力。
AtomGit 是由开放原子开源基金会联合 CSDN 等生态伙伴共同推出的新一代开源与人工智能协作平台。平台坚持“开放、中立、公益”的理念,把代码托管、模型共享、数据集托管、智能体开发体验和算力服务整合在一起,为开发者提供从开发、训练到部署的一站式体验。
更多推荐



所有评论(0)