登录社区云,与社区用户共同成长
邀请您加入社区
Google DeepMind开源实验性文本扩散大模型DiffusionGemma,采用并行去噪机制实现高效文本生成,推理速度达传统自回归模型的4倍。模型基于MoE稀疏架构,参数量26B,支持多模态输入与长上下文,在代码生成等任务表现突出。
国产AI生态发展迅速,企业关注点已从硬件选型转向实际部署能力。当前主流国产开源模型(DeepSeek、Qwen等)和推理框架(vLLM、LMDeploy等)已完成初步适配,RAG知识库系统已具备成熟落地条件。文章剖析了企业AI系统的全栈层级,指出软件生态兼容性比硬件参数更关键,并揭示部署中最易踩的三个坑:忽视软件兼容性、未做性能验证、忽略运维体系。目前国产AI在知识库等场景已无障碍,但Agent等
这两年,算力可以说是ICT行业的一个热门概念。在新闻报道和大咖演讲中,总会出现它的身影。那么,究竟到底什么是算力?算力包括哪些类别,分别有什么用途?目前,全球算力正处于怎样的发展状态?算力的字面意思,大家都懂,就是计算能力(Computing Power)。更具体来说,算力是通过对信息数据进行处理,实现目标结果输出的计算能力。我们人类,其实就具备这样的能力。在我们的生命过程中,每时每刻都在进行着计
近日,上海人工智能实验室(上海AI实验室)升级并开源DeepLink多元算力混合推理技术方案,在此前仅支持多国产芯片的基础上,拓展NVIDIA 等芯片跨架构混合推理能力,满足多类推理场景需求。为便于方案落地,上海AI实验室联合八家国产芯片厂商推出标准化推理镜像,开发者下载即可快速部署;开源上述方案核心技术——智能流量路由系统DLRouter,助力行业低成本构建高吞吐、低时延的异构推理服务。
知医邦以"算力搬运工"理念创新中医AI赛道:放弃高价硬件销售模式,专注算法与知识图谱研发,仅需智能手机和低成本腕带即可实现专业中医诊疗。其核心优势在于:1)大幅降低使用门槛,个人和机构无需昂贵设备投入;2)全产业链支撑,覆盖诊疗软件、药食同源产品及实体医院;3)真正践行"让中医变简单,为百姓省看病钱"的初心。通过AI辨证模型+轻量化硬件组合,让基层用户也能便捷获取专业中医服务,开创了中医智能化的普
AI时代,算力正成为制约中小团队发展的“隐形成本”。调查显示,许多团队面临GPU硬件昂贵、利用率低、管理混乱等问题,导致算力浪费严重。例如,初创公司GPU闲置率达25%,高校实验室因抢卡冲突降低科研效率。 OrionX社区版提出“更聪明的算力调度”方案,通过GPU池化技术(显存超分、vGPU隔离、K8s集成等),让多任务共享物理GPU资源,提升利用率至80%以上。实际案例中,企业节省50%硬件成本
【摘要】本周 AI 行业迎来密集重磅发布。国际上,英伟达 GTC 全面布局 AI 全栈,微软发布自研大模型加速 "去 OpenAI 化",Anthropic 冲刺 IPO,OpenAI 重启机器人业务,美国出台 AI 监管新政。国内聚焦产业落地,腾讯发布智能体工具集,首届全国 AI 高质量发展大会召开,国产大模型获巨额资本支持。
深圳市智恒百亿科技有限公司长期专注AI算力硬件适配与私有化部署配套服务,结合公司多年机房落地调试、压力测试、项目交付经验,针对市面主流8卡RTX5090算力整机,从7U机架机型落地角度,客观梳理选型要点与实测表现,为行业研发团队提供可参考的硬件选型依据。
【摘要】三大运营商将AI算力使用权包装为Token套餐,意味着大模型调用开始从“体验型免费”走向“可计量、可定价、可运营”的基础设施服务。围绕Token是什么、为什么由运营商推动、免费AI是否会消失、开发者和企业如何选型与避坑展开分析,帮助技术读者理解AI算力商品化背后的技术架构、成本逻辑和工程边界。
Token经济卡在哪?开放计算Token谱系给出系统解法
近期 AI 行业接连爆出两大重磅事件,一边是 OpenAI 新一代大模型核心信息从 Codex 日志意外泄露,150 万超长上下文、原生多模态 UI、代码能力大幅提升、面向超级智能体深度优化等特性曝光,市场对其6 月正式发布的预期持续升温;另一边国内 AI 硬件领域迎来突破性进展,9 款国产 AI 芯片集中通过安全可靠一级(最高等级)认证,覆盖训练、推理全场景,顺利拿到政务、金融等核心敏感领域的入
近日,,围绕能源支撑人工智能发展、人工智能赋能能源转型两大主线,部署了29项重点任务,力求加快构建“人工智能+”能源发展新格局。《关于促进人工智能与能源双向赋能的行动方案》《行动方案》明确提出到2027年初步构建安全、绿色、经济的能源保障体系,到2030年,人工智能算力设施的清洁能源供给保障能力、能源领域人工智能专用技术研发和应用达到世界领先水平,人工智能与能源双向赋能取得明显成效。
AI 大模型的规模化落地,正催生以 Token 为核心的全新经济范式。Token 作为 AI 算力消耗的最小单位,不仅重构了算力服务的计价逻辑,更重塑了数字产业的价值分配体系。本文深度剖析 Token 经济的底层逻辑,明确中国移动在算网安融合生态中的核心枢纽地位,拆解 “算力 + 带宽 + 安全” 打包为 Token 服务的商业模式,分析按需计费模式如何破解中小企业 AI 转型高门槛痛点,同时探讨
2026年5月19日(美国时间5月18日晚11点),OpenAI联合创始人Andrej Karpathy在X平台宣布加入Anthropic,引发AI圈震动。同日,中国科学技术大学潘建伟、陆朝阳团队宣布"九章四号"量子计算原型机研制成功,以3050个光子操纵规模刷新世界纪录,较全球最快超算El Capitan快10^54倍。本文深度解析这两则消息的技术背景、战略意义及对全球AI格局的深远影响。维度O
打 Kaggle 或国产大模型比赛,进入冲刺阶段,团队成员要同时跑不同的特征工程和模型融合方案。租云 GPU 成本飙升,一个月花掉好几千,团队预算吃紧。把团队已有的几张消费级显卡(如 4090)通过 OrionX 池化成一个虚拟算力池。显存超分技术让每张卡能支撑更大 batch size 或更高分辨率输入。成员按需申请算力,跑完即释放,避免资源闲置。云 GPU 租用成本降低 60%并行实验数量翻倍
本文分享了作者对多家AI API中转站的评测体验。经过两天测试,最终选择了一家表现稳定的平台,主要优势包括:模型质量不缩水、线路稳定、售后响应快;提供多种分组选择(官方8折、AWS/Azure线路、VIP4折、SP1.2折),满足不同预算需求;覆盖主流AI模型,支持IDE一键接入。实测发现SP分组虽价格最低但质量不减,性价比突出。文末还分享了CodeX使用技巧,建议在上下文达到70%时通过摘要总结
阵容上,既有昆仑万维、智谱、商汤、百度、蚂蚁、MiniMax这样的行业头部,也有亚马逊云科技、硅谷Fusion Fund带来的全球视角;既有复旦邱锡鹏、港大黄超代表的学界与开源前沿,也有盛大EverMind、太初元碁、趣丸科技等活跃实战派玩家。议程上,从Agent商业化落地、多模态与空间智能的最新突破,到AI在文娱、医疗、企业服务等场景的纵深渗透,再到算力与AI Infra的范式之变……这一年最值
当算力成为薪酬第四栏,你的工资条将迎来巨变!本文深度解析黄仁勋提出的“Token 薪酬”构想,揭示其背后的算力经济学与 10 倍生产力逻辑。这不仅是福利变革,更是开发者进阶的入场券,带你洞见未来职场核心竞争力 💡。
2026年5月13日是AI行业罕见的"多线突变日"——Amazon用Alexa for Shopping彻底替换Rufus聊天机器人,将搜索栏变成AI购物Agent;Meta发布WhatsApp Incognito Chat,实现"连Meta自己都看不到"的AI隐私对话;Sam Altman在OpenAI vs Musk审判中出庭辩护;AI能源危机加剧,SSD价格飙升300%,50%美国数据中心项
摘要:2026年5月,AI芯片公司Cerebras以488亿美元估值登陆纳斯达克(CBRS),IPO定价185美元/股,融资48亿美元。其晶圆级芯片WSE-3面积是英伟达H100的57倍,内存带宽达21PB/s,获OpenAI 200亿美元订单承诺750兆瓦算力部署。但86%收入依赖阿联酋客户,面临出口管制和英伟达竞争风险。Cerebras的IPO标志着AI芯片赛道多元化,其晶圆级架构在内存带宽上
为了让角色动起来自然,对于 Live2D 模型师和动画师来说需要把一张完整的插画抠得七零八落:刘海、后发、眼睛、衣服、配饰全都要分层,还要发挥想象力把被遮挡的身体部位重新画出来……这一套流程下来,简直是“掉头发”级别的折磨。然而【See-Through】上传一张动漫角色插画,自动将其分解为带有深度排序、完整修复的语义图层,并导出为分层 PSD 文件。
本次测试均基于相同的瑞芯微原厂rknn_yolov5_demo环境,采用统一的 yolov5s-640-640 模型和 640*640 分辨率测试图片。次旗舰RK3576展现出首次加载略有差距、连续运行性能高度逼近旗舰的特点,在绝大多数常规 AI 推理场景中都能提供出色体验,总的来说RK3576是兼顾性能与成本的高优选型方案。测试均基于相同的rknn_yolov5_demo环境,采用统一的yolo
【摘要】当行业普遍将Token视为需要压缩的成本时,一种反直觉的战略正在头部玩家中悄然成型:最大化地使用最昂贵的顶尖模型。这并非盲目“烧钱”,而是一种将Token从成本中心转变为核心生产力杠杆的深度认知。通过解析真实案例与产业链动态,揭示这一战略如何重塑竞争格局,并为企业与个人指明通往未来的唯一路径。
MatAnyone2是由南洋理工大学S-Lab和商汤科技联合开发的视频抠图框架。该技术采用记忆传播机制,通过区域自适应记忆融合实现稳定的视频抠像效果,能精准处理发丝等细节。其特点包括首帧锁定目标、智能记忆稳定和超清细节处理,适用于视频背景替换、直播特效、电影制作等场景。项目已在GitHub开源,并在趋动云平台提供一键部署服务,支持快速体验。该技术突破了传统视频抠图需要逐帧调整的限制,实现了自动化高
DeepSeek V4以"厘时代"定价打破行业价格体系,推动AI应用从试点走向普及。2026年下半年,中国AI产业核心主线转向:低价模型激发推理需求爆发,国产算力适配进入兑现期。三大趋势明确:推理算力规模将首超训练、国产GPU迎来真实订单、云厂商成最大赢家。市场焦点从"谁最聪明"转向"谁能承载最多用户",基础设施兑现能力决定下一阶段红利归属。
纵览本周通信与算力基建领域的三条主线,我们看到的是一盘关于未来AI发展的宏大棋局:中国移动正面进攻“快”——5G-A超级上行的千兆速率突破,以及“中试基地+生态联盟+梯次推进”三重生态加速机制的构建,正在驱动AI与通信从“粗放部署”迈向“系统协同”的深度融合,为云端机器人、高清直播和具身智能的规模化应用铺平信息传输的快车道;中国信通院解“电”
科技行业近期呈现多领域爆发态势:英特尔和AMD股价创历史新高,显示CPU在AI智能体时代价值重估,预计需求将激增4倍。我国加速太空算力布局,计划2035年前部署2800颗算力卫星,并实现天地协同技术闭环。国产AI生态取得突破,DeepSeek-V4与华为昇腾深度协同,验证全栈国产方案的商业可行性。AI编程领域,KimiK2.6开源模型支持12小时自主编程和300子Agent并行。同时,AI需求引发
碳基时间与硅基时间对比摘要(149字) 碳基时间代表生物节律,受昼夜、代谢等生理限制,具有间断性和主观性;硅基时间则基于电能驱动,表现为连续运算和极速处理能力。两者的对比凸显了生命形态的根本差异:碳基时间体现人类有限的生物特性与情感体验,硅基时间展现机器的无限算力与精准记忆。当前讨论这一对概念,既反映碳硅文明融合的趋势,也引发关于存在本质的思考——人类如何在AI时代保持独特价值。这种时间观的碰撞,
当AI生成图片与真实照片几乎无法区分时,“眼见为实”的认知基础正在被动摇。社交媒体上,网友用Images 2.0生成了“马斯克直播带货”、“学术论文截图”等图片,真假难辨。OpenAI表示,新模型延续了C2PA数字水印技术,每张生成的图片都携带不可见的元数据标识,可通过专业工具溯源验证。但数字水印只能“事后追责”,无法阻止生成本身——AI伪造的成本已经降低到“一句话即可完成”的程度。2026年4月
《精度的战争:AI计算从精确走向概率的革命》摘要 人工智能领域正经历一场计算精度的范式革命。传统FP32高精度计算在AI训练中显得冗余且低效,业界正快速转向FP16、BF16等低精度格式。最新突破是英伟达Blackwell架构采用的FP4格式,通过极致的4位压缩实现32倍算力提升,这得益于微缩放技术等创新。华为也推出HiF8参与标准竞争。这场革命揭示了一个深刻洞见:智能的本质不在于数值精度,而在于
时间线摆在一起看就很清楚了。2025 年 4 月,美国商务部通知英伟达,H20 对华出口需要许可证,政策"无限期有效"。H20 本来就是给中国"降级"的特供版,现在连这个都卡了。英伟达自己披露,光 H20 相关的库存和储备费用就 55 亿美元。对 DeepSeek 来说,这不是未来风险,是现成的问题。V3 是拿英伟达卡训练出来的,后续的模型迭代如果还要等英伟达供货,节奏完全不在自己手里。再看华为这
摘要: 工信部2025年密集出台算力政策,为县级融媒体发展提供新机遇。《算力互联互通行动计划》构建"算力互联网",2026年专项行动推动城域1毫秒时延圈建设,普惠算力政策支持县域数字化转型。县级融媒体面临数据安全、AI内容合规等新挑战,可通过政策赋能:1)利用"可信验证"体系保障数据安全;2)依托边缘算力节点实现本地化部署;3)接入国家算力平台共享安全能力。
高校AI实验室常面临GPU资源紧张与闲置并存的困境。某985实验室仅2张A100需支撑5个模型训练、3个实时Demo和1条评估流水线,利用率仅25%。通过部署OrionX社区版(免费GPU池化软件),实现任务并行执行,利用率提升至85%,实验周期缩短近半。该方案支持资源隔离、远程调用和显存超分,无需代码改造,已在国内多所高校验证有效性。在高端GPU紧缺的现状下,提升现有资源利用率比购置新卡更具现实
《光速枷锁:AI算力竞赛背后的物理极限》揭示了现代计算技术面临的终极瓶颈——光速限制。文章通过生动的比喻指出,在纳秒级运算的芯片世界里,光信号传播1米需要5纳秒,而GPU一个时钟周期仅0.56纳秒,这种速度落差导致大规模计算集群面临严重的通信延迟问题。作者深入分析了万卡级AI集群的物理限制:当集群规模达到百万张GPU时,光信号往返延迟将超过20微秒,使系统性能遭遇阿姆达尔定律的"高墙&q
【科技热点速览】周末技术圈动态频出:1)人形机器人半程马拉松在北京亦庄举行,国产机器人"闪电"以50分26秒夺冠,超越人类世界纪录;2)半导体行业涨价潮持续,联电宣布晶圆最高涨价15%,阿里云、百度智能云同步上调AI算力价格;3)AI芯片领域竞争加剧,谷歌与Marvell合作开发推理芯片,Meta与博通扩大合作至2029年;4)RISC-V生态快速发展,进迭时空芯片成功适配Op