登录社区云,与社区用户共同成长
邀请您加入社区
MindSpore 大模型套件以分布式并行、轻量化微调、高性能推理、工程化工具为核心,构建了大模型全栈研发体系。通过开箱即用的模型组件、极简的 API 接口、深度的硬件优化,让开发者快速实现大模型训练、微调和部署,大幅降低大模型技术门槛,加速大模型在各行各业的创新应用。
通过前面19节课的学习,你已经能构建一个功能完整、经过评估测试的AI Agent了。它在本地跑得风生水起,Demo演示时全场叫好。但产品经理问了一个让你瞬间清醒的问题:“什么时候能上线给全公司用?然后你发现,本地跑得好好的Agent,要变成生产环境可用的服务前端要标准化的API接口,还要支持流式输出运维要API Key认证、限流、监控、日志测试要Swagger文档、自动化测试接口你自己要处理超时、
startup_tasks 是一个轻量级 Dart 启动任务编排库,帮助 Flutter/Dart 项目按阶段、依赖关系和并发策略组织初始化流程,并统一处理超时、重试、失败降级与启动报告。
第三方库要做兼容性测试 工具:友盟 U-APM 免费集成。· 按系统版本聚合,发现集中在 iOS 16.4。· 临时降级到旧版本 · 一周后修复版本上线。· 完整堆栈信息,定位到第三方库内存泄漏。AI App 上线第一天崩溃率 8%。· 崩溃日志要按系统版本、设备型号聚合。· 联系第三方库作者确认问题。· 上线前必须接崩溃监控。崩溃率降到 0.3%。
2026年AI检索普及推动营销变革,传统关键词堆砌模式失效。GEO生成式引擎优化成为破解流量内卷的新方案,通过构建权威信源矩阵(官网、媒体背书、百科等)实现精准获客,替代盲目铺量的低效营销。其核心是数据驱动的精细化运营,监测AI引用率、转化率等指标,提升营销效率。当前行业同质化竞争严重,GEO通过"质量优先"逻辑帮助品牌抢占AI流量红利,成为企业数字化升级的必选项。
前端性能优化:重排与重绘的避免策略 本文系统介绍了浏览器渲染流程中重排(Reflow)和重绘(Repaint)的概念及其性能影响。主要内容包括: 浏览器渲染流程:Style→Layout→Paint→Composite四个关键阶段 重排与重绘的定义及区别:重排影响几何属性,重绘影响外观属性 常见触发重排的操作:修改尺寸、位置、DOM结构、display属性等 强制同步布局问题:读取offsetWi
随着企业级AI Agent应用的大规模落地,作为Agent集群管控核心的Harness层正面临前所未有的高并发挑战:高峰期十万级QPS的流量潮汐、异构算力节点的资源差异、Agent有状态特性带来的调度复杂度、不同优先级请求的SLA保障要求,都让传统微服务负载均衡方案完全失效。
去年这时候,我也是那种"看了很多 Agent 教程,但什么都没做出来"的人。不是没有努力。我装过 LangChain,照着文档走,`agent.run("帮我查天气")` 确实跑通了。
推荐使用 **“Chrome Store Foxified”** 或 **“Firefox Multi-Account Containers”**(后者虽不是直接加载,但能辅助管理扩展)。火狐150.0.3的“暴力玩法”并非噱头,而是一次对浏览器扩展生态的重新定义。- **跨平台扩展加载**:支持安装`.crx`(Chrome扩展)、`.xpi`(火狐原生扩展)以及部分Edge扩展。- **定期清
KV Cache是大模型推理优化里投入产出比最高的一环。正确配置vLLM的max_batch_size和gpu_memory_utilization打开Prefix Caching如果显存紧张,KV Cache量化到INT8这三步做完,吞吐量轻松翻倍。说白了,很多性能问题不是模型不行,是部署的人没配好缓存。下一篇我打算聊聊vLLM里PagedAttention的底层实现——那个才真叫精巧。感兴趣的
你有没有遇到过这种场景:线上接口突然变慢,用户疯狂投诉,DBA 让你赶紧查 SQL,你盯着 Explain 结果看了半天,依然不知道问题出在哪里?别慌,这篇文章就是写给你的。我会用真实的业务案例,手把手带你从 Explain 的每一个字段入手,一步步把一条 8 秒的慢查询优化到 50 毫秒以内。不讲虚的,全是干货,看完你就能直接上手改。
OpenHuman是一款开源的个人AI助手系统,旨在超越传统聊天机器人,提供长期记忆、外部服务集成和任务执行能力。其核心架构包括输入层(多源数据)、记忆层(结构化Memory Tree)、存储层(SQLite+Markdown)、调度层(智能模型路由)和工具层(实际任务执行),形成完整的AI闭环系统。该项目通过整合记忆管理、上下文理解、工具调用和模型调度等关键技术,探索了个人AI助手从简单问答转向
昇思大模型(MindSpore)基于昇腾NPU与鲲鹏架构,通过自动并行、图算融合等技术实现高效多模态内容生成。其核心技术包括MindSpore框架、昇腾硬件加速和多模态融合,支持文本、图像、音视频的智能生成与理解。应用覆盖内容创作、医疗、工业等领域,典型案例包括智能分诊系统和新能源预测。实操指南涵盖环境搭建、模型训练及部署优化。未来将聚焦技术演进、生态拓展和伦理规范,推动智能内容生产发展。
本文介绍了昇腾AI平台在计算机视觉(CV)和自然语言处理(NLP)模型微调方面的全栈解决方案。平台基于DaVinci架构、CANN异构计算架构和昇思MindSpore框架,提供硬件加速、异构调度和轻量化微调等优势。文章详细讲解了环境配置、数据处理、模型加载和微调训练的全流程,包括ResNet50图像分类和BERT文本分类的具体实现。重点介绍了混合精度训练、数据集下沉模式、算子融合优化等关键优化策略
摘要: 本文分享了10个实用的SQL优化技巧,帮助提升查询性能。包括避免使用SELECT *、合理使用LIMIT、通过EXPLAIN分析查询计划、为高频字段添加索引、避免在WHERE子句中使用函数、用JOIN替代子查询、用IN或UNION代替OR条件、批量操作减少交互、使用EXISTS替代IN以及定期优化表碎片整理。此外还建议先优化SQL再考虑硬件配置,通过EXPLAIN定位问题。这些技巧简单易用
经验沉淀、UWA AI双助力,攻坚排障更高效
独立开发者如何用Trae CN+SiliconFlow+QClaw三个AI工具协同作战?从写代码、调API到做表格,完整复盘一套“人机协作”的高效工作流。
在实际的工程结构分析中,不确定性无处不在。材料参数的离散性、几何尺寸的制造误差、荷载的随机性以及边界条件的模糊性,都使得确定性分析方法难以准确描述结构的真实行为。结构动力学中的不确定性分析,旨在量化这些不确定性对结构动力响应的影响,为结构的安全评估和可靠性设计提供科学依据。不确定性通常分为两类:偶然不确定性(Aleatory Uncertainty)和认知不确定性(Epistemic Uncert
智能体是多智能体系统中的基本决策和执行单元。核心属性:感知(Perception):获取环境信息的能力决策(Decision Making):根据感知信息选择动作的能力行动(Action):改变环境状态的能力状态(State):智能体的内部状态表示。
在当今人工智能技术蓬勃发展的时代,多智能体系统(Multi-Agent System, MAS)已经从理论研究逐步走向实际应用,成为人工智能领域最具活力的研究方向之一。从自动驾驶车队的协同调度,到智能制造中的机器人协作;从电商平台的推荐系统,到金融市场的交易策略优化;从游戏AI的策略博弈,到智慧城市的资源管理,多智能体系统正在各个领域展现出巨大的应用价值和发展潜力。多智能体系统由多个自主决策的智能
不确定性量化(Uncertainty Quantification, UQ)是现代结构动力学分析的重要组成部分。本主题系统介绍结构动力学中不确定性的来源、分类和量化方法,包括随机有限元方法、多项式混沌展开、贝叶斯模型更新和可靠性分析等核心技术。通过Python实现多个典型案例,展示如何在实际工程问题中处理材料参数、几何尺寸、边界条件和载荷的不确定性,为结构的安全评估和优化设计提供理论基础和实践指导
不确定性量化(Uncertainty Quantification, UQ)是现代结构动力学分析的重要组成部分。本主题系统介绍结构动力学中不确定性的来源、分类和量化方法。重点讲解蒙特卡洛模拟、多项式混沌展开、随机有限元方法等核心算法,以及结构可靠性分析和敏感性分析方法。通过Python实现各种不确定性量化技术,帮助读者掌握处理工程实际中参数不确定性、模型不确定性和载荷不确定性的能力,为结构安全评估
本文介绍了软件开发中的职责链模式,通过将多个处理对象连成链来解耦请求发送者和接收者。文章从公交车投币等生活实例入手,以电商订单处理为例展示传统实现方式的弊端,并通过拆解函数、创建Chain类等方式重构代码,实现灵活可扩展的职责链。同时探讨了异步职责链和AOP实现方式,分析了该模式解耦灵活等优点和性能损耗等缺点。最后指出职责链模式在作用域链、事件冒泡等场景的广泛应用,强调其提高系统灵活性的价值。全文
慢查询并非“执行时间长”的表面现象,而是底层执行逻辑与资源消耗的双重问题:一是执行计划不合理(如全表扫描、索引失效),导致IO次数过多;设计时需将高选择性字段(如用户ID、订单号)放在联合索引前列,低选择性字段(如性别、状态,选择性<0.1)尽量不单独建索引,避免优化器放弃使用。索引是MySQL性能优化的核心手段,其本质是“基于B+树的有序数据结构”,目的是减少磁盘IO次数。捕捉到慢查询后,需通过
如果你关注 2025 年到 2026 年各大厂的 AI 产品动向,会发现一个反常识的现象。腾讯 CodeBuddy 2.0 重点推出了"计划模式",核心能力跑在终端里。阿里 Qoder 专门为脚本化和 CI/CD 场景重写了一套 CLI 工具链。谷歌 Gemini CLI 甚至支持在终端里多模态输入输出,直接处理代码和图像。微软这边,PowerToys 和应用商店双双加入命令行能力。
Vue项目INP优化方案:针对图片预加载导致的主线程阻塞问题,提出分块空闲预加载方案。通过requestIdleCallback API将360张图片分成小块(每次10张)在浏览器空闲时加载,避免长任务阻塞交互响应。优化后移除了setTimeout延迟调用,改用非阻塞式预加载,并在完成后通过$nextTick初始化视图。该方案结合性能分析工具,系统性地解决了INP指标差的问题,显著提升了页面响应速
本文详细介绍了使用JMeter测试通义千问(Qwen)大模型API性能的完整方案。测试计划采用XML格式,通过层次化结构组织线程组、HTTP请求、定时器和断言等组件。关键配置包括:10个并发线程、60秒测试时长、100-500ms请求间隔、HTTP/JSON断言验证。测试重点监控QPS、响应时间和错误率等指标,并提供了不同场景的参数调优建议。文中特别强调了API限流问题,建议测试前确认账户QPS限
摘要: 本文聚焦JVM调优核心参数,涵盖堆内存分配(新生代/老年代)与GC日志配置两大模块。堆内存参数包括-Xms/-Xmx(初始/最大堆)、-Xmn(新生代大小)、-XX:SurvivorRatio(Eden区比例)等,通过合理配置可减少GC频率与OOM风险;GC日志参数如-XX:+PrintGCDetails、-Xloggc等帮助分析GC性能。文中提供实战配置示例,并解析面试高频问题(如-Xm
云测试平台已成为现代软件交付的核心基础设施,通过弹性资源调度和自动化环境编排显著提升测试效率。Jenkins作为关键调度中枢,其Master-Agent架构和容器化部署可优化测试执行。针对性能瓶颈,提出七大优化秘籍,包括缓存层、智能分片和轻量镜像等。某电商团队实践后,测试效率提升300%,反馈周期缩短92%。未来将向Serverless测试、TestOps平台化和混沌测试方向发展,推动测试人员向质
在数据库工程中,SQL优化是提升系统性能的关键环节。据统计,通过合理的SQL优化可减少60%以上的数据库负载,提升应用响应速度3倍以上。本文将深入解析SQL优化核心策略,结合真实案例与Explain工具分析,助你掌握从理论到实战的完整优化方法论。
对比分析 MCP 与 CLI 协议在 AI 代理中的 token 消耗问题,揭示 CLI 方案节省 94% 成本的优势,并探讨认证难题与未来融合方向。
在数据库性能调优领域,SQL优化始终是开发者与DBA的核心战场。一条精心优化的SQL语句,能让百万级数据的查询从秒级响应跃升至毫秒级,而错误的索引策略则可能让生产环境陷入瘫痪。本文通过5个真实优化案例与3大索引策略体系,结合Explain工具深度解析,揭示SQL优化的底层逻辑与实战技巧。
一、核心结论大模型训练与推理优化的本质是对硬件资源的高效利用,其核心均围绕算力、显存、显存带宽、通信带宽四大资源,持续逼近硬件物理极限。关键技术实践表明:1.数据层面:高质量、多样化的数据是模型性能的基础,合理的数据组合和清洗能显著提升训练效率和模型效果;2.训练层面:并行化策略、显存优化技术(梯度累积、混合精度)、训练框架(DeepSpeed、Megatron-LM)是提升训练速度、降低成本的核
本文系统介绍了MySQL 5.7性能优化的关键策略,包括查询优化、索引使用和数据库结构设计。在查询优化方面,详细讲解了EXPLAIN分析工具的使用方法、索引选择性和组合索引的最左前缀原则,以及如何避免索引失效和优化子查询。数据库结构优化部分提出了垂直分表、水平分表和适度冗余等实用方案,通过拆分大表、创建中间表和冗余关键字段来提升查询效率。文章结合电商系统等商业场景,提供了大量实战案例,帮助开发者从
AI时代的并行优化技术
这几年WM Shell部分也在不断更新,而且基本上互联网,AI等对于WM Shell的知识几乎是空白的啥也搜不到,马哥这边对于WM Shell出了自己去代码调研以外,也会经常去寻找一些官方的文档资料进行学习,下面就是关于WM Shell相关的官方文档路径。今天分享一下我们比较陌生的的WM Shell的线程知识,针对这块我们一起看着官方文档学习哈,有啥要讨论分享的知识可以vip群中讨论发言哈。
场景框架原生算子局限自定义算子价值稀疏训练标准 Dropout 无法处理动态稀疏开发,显存降低 60%大模型推理FlashAttention 未集成移植优化版,吞吐提升 2.8 倍国产化迁移CUDA 算子无法在昇腾运行重写 Ascend C,性能反超 GPU算法创新新论文提出定制算子快速验证,抢占研究先机💡 案例:某自动驾驶公司开发 BEV 池化算子,将感知模块延迟从 45ms 降至 18ms,
本文复盘了一次由海外大模型API限流引发的生产事故,深入剖析了大模型流式响应(SSE)导致网关OOM的技术原理。核心发现是"半开连接"与"背压击穿"引发堆外内存泄漏,传统熔断机制无法解决物理层问题。团队最终采用七牛云AI Token API进行架构重构,通过边缘节点加速和自动灾备,将P99延迟降低94%,错误率降至0.01%,同时节省35%成本。案例证明,企
你是否经历过这样的场景:用户反馈页面加载缓慢,运营团队催促优化数据库性能,而你却苦于找不到SQL优化的突破口?在数字化业务高速发展的今天,SQL优化已成为数据库工程师的核心竞争力。本文将通过SQL优化关键词,结合索引策略示例、查询优化案例及Explain对比实操,为你揭示让查询速度提升5-10倍的终极方法论,助你从“SQL调优新手”蜕变为“性能优化专家”!
很多前端能把“宏任务与微任务”倒背如流,却在面对“浏览器每一帧到底做了什么”时大脑一片空白。Event Loop 是如何与浏览器的渲染流水线(Style/Layout/Paint)交织在一起的?神秘的 requestIdleCallback 到底在哪个夹缝中生存?超时后为什么必须降级为宏任务?本文带你穿透 16.6ms 的生死线,用图解彻底打通从 JS 引擎到渲染引擎的任督二脉。看完这篇,再也不怕
你是否遇到过数据库查询慢如蜗牛,用户频频投诉页面卡顿?在电商大促、金融结算等高并发场景下,毫秒级的性能差异可能直接影响百万级营收!本文深度揭秘SQL优化核心逻辑,通过索引策略示例、查询优化案例及Explain对比实操,助你掌握让查询速度提升10倍的终极密码——从复合索引的"最左匹配"陷阱到部分索引的存储空间压缩术,从执行计划的type列解读到分页查询的索引优化方案,带你实现从"SQL调优小白"到"
基础部署只是开始,真正的威力在于自定义技能。本文教你如何为 OpenClaw 开发专属技能,打造属于自己的 AI 助手生态。
UWA AI、社区双助力,解难题更高效
LIMIT 1确实是个好习惯,但也要看场景。在这个案例里,MySQL 的优化器因为过度自信,觉得“很快就能找到这一条”,结果在数据分布不均匀的情况下翻了车。下次如果再遇到加了限制反而变慢的问题,直接用 EXPLAIN 看看,因为优化器有时候也是会做出抽风的事!
Agent 的本质决定了:你不能只监控系统运行状态,更要监控它“如何思考、如何行动、是否真正解决问题”。把结构化人工标注、自动模式发现和持续在线评估组合起来,让生产 trace 成为持续优化的燃料。对正在做 Agent 产品的团队来说,这不是“锦上添花”,而是从 Demo 走向可持续生产的必经之路。
你是否经历过这样的场景:电商大促期间订单查询卡顿15秒,用户纷纷流失;社交平台消息列表加载延迟,用户活跃度骤降。本文通过电商、社交、物联网三大真实场景,拆解单列索引、复合索引、覆盖索引等九大策略,结合EXPLAIN执行计划对比,揭示从15秒到50毫秒的性能革命密码。