登录社区云,与社区用户共同成长
邀请您加入社区
从需求到详细设计,AI 最大的价值不是"替你做决定",而是把架构师从重复性的结构化工作中解放出来。字段表、接口定义、Mermaid 图、文档组织——这些工作 AI 可以在几分钟内完成,而且格式统一、不会遗漏。而架构师可以把精力集中在真正需要经验和判断力的地方:聚合边界是否合理、并发策略是否恰当、业务规则是否完整。这不是"AI 取代架构师"的故事,而是"AI 让一个架构师能做十个模块的详细设计"的故
咱们一口气聊了六种LangGraph状态图的设计模式,从最简单的线性流,到条件路由、循环反思、并行分流、多Agent协作,最后到嵌套子图。这其实就是一条清晰的能力成长路径:先能把直线跑稳,再学会分叉决策;先能让Agent自我纠错,再让它学会团队协作;最终,通过子图封装驾驭真正的工程复杂度。很多新手总想把架构一步到位,殊不知,这些模式不是让你一开始全都堆砌上去的,而是让你在面对不同问题时,心里有底,
摘要 本文记录了作者使用Codex开发Agent完成"博士猫"AI个人知识库MVP的全过程。该项目核心功能包括支持PDF/EPUB/Markdown/Word文档导入,实现中文全文与语义混合检索,并基于检索证据生成带真实引用的回答。项目最终封装为macOS应用。 开发过程中,作者对AI编程的认识经历了三个阶段转变:从最初的"自动生成完整产品"的误解,到发现其作为协作开发伙伴的价值,最终形成"人负责
本文介绍了一款集成在ALM平台的AI工具如何帮助汽车电子工程师高效完成ASPICE CL1评估准备。该工具能通过自然语言指令启动自动化检查流程,快速识别需求文档中的规范性、一致性等基础问题,生成可视化问题清单和整改建议,显著降低人工核查成本。系统支持实时生成自检报告,预先暴露合规风险,避免评估现场出现低级错误。
本文对比了AI任务处理中直接生成与反思机制的效果差异,探讨了零样本提示与多样本提示的应用场景。实验数据表明,反思机制在各类任务中的表现优于直接生成,尤其在需要高准确度的任务中效果显著。文章通过具体案例(如HTML代码编写、泡茶步骤等)展示了反思提示词的实际应用,并提供了两大实操技巧:明确指示反思动作和提供具体审查标准。这些提示词工程技巧能有效提升AI输出的质量和准确性,帮助解决模型在简单任务上容易
你团队现在跑的几百个测试脚本里,哪些适合抽象成 Skill,哪些天生就不适合 Agent 调用?如果你还没开始问这个问题,一年后这些脚本大概率会变成没人维护的技术债。而能够回答这个问题的人,已经在构建下一个周期的测试基础设施了。
摘要(148字): ReAct是一种结合推理(Reasoning)与行动(Acting)的智能体模式,通过思考→行动→观察的循环处理复杂任务。典型流程:1)思考问题并规划行动;2)调用工具执行;3)获取结果并评估。若信息不足则循环,直至输出最终答案(如查询股价需先搜索再返回结果)。其优势在于提升准确性(整合外部数据)和可解释性(透明推理过程),适用于代码生成、数据分析等需多步交互的场景。例如代码重
基于Harness+ Langgraph+ A2A写一个 Agent Team,实现一支硅基团队自己 写代码
独立设计师的工具清单在 2026 年必须覆盖七大必备功能:AI 自然语言生成、流程画布与多页面规划、组件库与设计系统、可交互原型与模拟器、代码导出与交付、客户协作与评审分享、资产管理与版本控制。MBO Partners 2025《State of Independence》报告给出的 74% AI 使用率与 61% 时间节省反馈、Progress/Telerik 2025 年度报告的 84% 团队
面试官:你们 RAG 知识库上线之后,文档更新了怎么办?总不能每次改个文档就把整个知识库重建一遍吧。
如果你做过**企业级 RAG**,你一定经历过这种无奈:不管怎么调向量模型、换 embedding、加 HyDE 改写,复杂查询的效果就是上不去。**大多数人会归咎于搜索引擎**——召回率不够、排序不准、语料没处理好。
我第一次写多 Agent 系统时犯过一个错误:把所有工具塞进一个 tools 数组,然后把这个数组挂给每个 Agent。结果上线后发现:负责写文章摘要的 Agent,有时候莫名其妙地调用了删除接口;负责检索资料的 Agent,偶尔会触发支付工具。不是 bug,是 LLM 的「创意发挥」——它看到工具就会用。
《Agentic Design Patterns》是一本424页的AI Agent设计模式实战指南,系统性地将Agent系统构建拆解为21个核心设计模式和7个技术附录。该书将复杂的Agent系统构建经验提炼为可复用的模式语言,帮助开发者像搭积木一样构建可靠的AI智能体系统。
通过这一周的学习,我学会了以下几点:1. 了解了项目的安排1.1. 第一阶段:01. 项目GUI + AI基础技术(数据集处理 + 机器学习[特征的分类] + 深度学习[特征的学习])02. 模型实现 + 模型训练1.2. 第二阶段:01. 实现模型 + AI工程技术(数据集标签 + 数据集工程 + 目标侦测 + AI推理模型)1.3 第三阶段:...
文章摘要 本文系统梳理了从RLHF到GRPO的强化学习训练大模型技术演化历程。RLHF通过引入PPO算法显著提升了模型性能,但也面临Critic模型占用显存大、训练不稳定、奖励模型不可靠等问题。DPO方案通过解析解绕开RL直接优化偏好数据,但无法动态探索。DeepSeek-R1采用的GRPO创新性地去掉了Critic模型,通过组内相对比较实现验证,使显存需求降低40%,推理能力显著提升。技术路线的
2024年大模型Agent领域竞争激烈,Claude Code源码泄露揭示了生产级AI编码助手的12个核心设计模式,分为记忆与上下文、工作流与编排、工具与权限、自动化四大类。这些通用模式解决了Agent开发中的关键痛点:如何高效管理记忆、有序推进任务、控制操作风险和减少重复劳动。文章重点解析了记忆与上下文相关的5个模式,包括持久化指令文件、作用域上下文组装和分层记忆等,通过生活化类比和实战建议,帮
BOSS直聘、智联招聘,肯定要投。但真正的机会,可能不在那。GitHub:关注热门AI项目,很多招聘信息藏在README里技术社群:微信群、Discord、飞书群……很多初创团队直接在群里招人AI开发者社区:Hugging Face、ModelScope……活跃起来,机会自然来这个圈子,内推比海投管用10倍。1. 别被焦虑绑架,AI是一张新牌桌。2. 不用手推公式,会搭应用就够了。3. 简历上放“
《智能体用户界面设计与体验评估标准发布》摘要:联想联合蚂蚁、百度等企业制定的《智能体用户界面设计指南》和《智能体用户体验评估指南》两项团体标准于3月24日正式发布。这是国内首批智能体产品标准化文件,采用四层架构规范设计语言、核心准则和交互路径,并创新提出"三维一体"评估模型。标准将推动产品设计从"功能思维"向"体验思维"转变,要求产品经理
《AI时代测试工程师的三大核心技能》摘要:在AI深度参与软件测试的背景下,人类测试工程师需聚焦三大不可替代能力:1.业务场景理解力,将业务规则转化为测试策略;2.批判性思维,识别系统级风险并设计测试框架;3.战略沟通能力,将技术数据转化为商业决策依据。未来测试模式将演变为人类负责质量策略制定与价值判断,AI执行具体测试任务的人机协同新范式,推动测试工程师向"质量架构师"转型。
十年前,会写 PRD 和跟项目就是合格的 PM;五年前,数据分析是必备技能。而今天,在AI设计工具的冲击下,产品经理要保持竞争力,交互设计能力已经从“加分项”变成了中高级 PM 的硬门槛。
手动触发:用户可通过/compact命令显式要求压缩,并可指定保留的关键信息,比如/compact 请特别保留关于项目架构的讨论内容,确保核心信息不被遗漏。自动触发:这是系统默认行为,系统会实时监控Token用量,设定一个水位线,当当前Token用量超过“上下文窗口大小 - 预留空间”时自动触发。
本文对智能AI镜头产品的芯片选型进行了全面对比分析。基于产品需求,从性能、成本、功耗等维度评估了瑞芯微RV1126、RK3588和地平线RDK3、RDK5四款方案。结果显示:瑞芯微RV1126性价比最优(单价8美元/2TOPS/1.5W),适合智能门锁等成本敏感场景;地平线RDK3(12美元/5TOPS)满足国产化需求;RK3588(45美元/6TOPS)适用于高性能产品;RDK5(35美元/12
本文直击中小企业 AI 落地的核心痛点:AI 项目沦为算法工程师的 “一次性手工作品”,普遍出现 “人走项目崩、重复造轮子、百万投入打水漂” 的问题。文章拆解了问题根源,给出 4 步紧急止血方案、体系化根治策略与 3 个月落地执行计划,帮企业把个人 AI 能力转化为可传承、可复用的组织标准化资产,彻底解决 AI 落地难、留存难的行业通病。
Agent工程,是将具有不确定性的语言模型系统,通过系统化的方法持续打磨,最终转化为可靠生产级应用的全过程。构建 → 测试 → 部署 → 观察 → 改进,然后周而复始。部署不是终点,而是优化起点。在Agent工程中,应用上线后才真正进入价值创造的核心环节——通过与真实用户的持续交互,沉淀知识、积累记忆、优化行为模式。正如近期备受关注的OpenClaw,正是在部署运营后,通过与用户的反复互动不断进化
本文指出AI岗位平均月薪高达60738元,远超新经济行业平均水平。AI能力已从技术岗专属变为全行业通用技能,近八成公司要求员工具备AI能力。AI岗位缺口巨大,供需比仅为0.97,企业更看重实际能力而非学历。AI时代为普通职场人提供了重新选择的机会,建议积极学习AI技能以抓住转行机会。最近刷到脉脉刚发布的《2026年1-2月中高端人才求职招聘洞察》,里面一组数据直接给我看愣了:AI岗位的平均月薪已经
Agent设计模式是AI自主行动的核心框架,包含三种模式:1)ReAct模式(边思考边行动),适用于多步探索任务;2)Plan-and-Solve模式(先规划后执行),适合工程开发等结构化任务;3)Reflection模式(自修正),通过反思提升输出质量。选型需根据任务复杂度、流程灵活性和容错需求决定。例如,代码重构Agent建议结合Plan-and-Solve与Reflection,分步执行并验
基于对学术论文、工程博客和技术报告的广泛研究,以下是围绕六个主题的关键发现,并特别针对超图灵机设计给出具体建议。
本文从技术法律角度解读美国最高法院关于AI生成内容版权的终审裁定,分析纯AI自动生成、AI辅助人工干预、人类主导三种场景的版权归属和应用建议,给出企业使用AI设计工具的合规方法和创作轨迹记录建议。
很多人以为做AI Agent,就是调调API、写写Prompt。说实话,真干起来完全不是一回事。
本文介绍了软件开发中的职责链模式,通过将多个处理对象连成链来解耦请求发送者和接收者。文章从公交车投币等生活实例入手,以电商订单处理为例展示传统实现方式的弊端,并通过拆解函数、创建Chain类等方式重构代码,实现灵活可扩展的职责链。同时探讨了异步职责链和AOP实现方式,分析了该模式解耦灵活等优点和性能损耗等缺点。最后指出职责链模式在作用域链、事件冒泡等场景的广泛应用,强调其提高系统灵活性的价值。全文
过去一年,越来越多企业开始建设AI 知识库系统。几乎所有方案都会提到一个技术:Retrieval-Augmented Generation(RAG)。
最近刷 Claude Code、Cursor、Gemini CLI 的同学,肯定都有同一个痛:你把 SKILL.md 写得天花乱坠,YAML 格式完美,目录结构标准,结果跑起来还是“今天神明天鬼”。其实格式早就不是瓶颈了。现在 30+ 个主流 Agent 工具全在用同一套 Skill 规范,包装问题已经彻底解决。真正的硬核差距,在。我把 Anthropic、Vercel、Google 内部的高手实
模式速查- 核心假设:任务依赖图中存在独立节点,并发执行可显著降低端到端延迟。- 关键约束:必须严格识别无依赖节点,需限制最大并发数以防资源耗尽。- 失败主因:强依赖任务强行并行导致死锁/不一致 + 部分失败未隔离导致整体阻塞。- 升级信号:多工具调用无时序要求、需批量处理数据、追求高吞吐响应时。- 首选框架:Asyncio / 线程池 → 分布式任务队列(Celery/Ray)。
对于正在迷茫择业、想转行提升,或是刚入门的程序员、编程小白来说,有一个问题几乎人人都在问:未来10年,什么领域的职业发展潜力最大?答案只有一个:人工智能(尤其是大模型方向)当下,人工智能行业正处于爆发式增长期,其中大模型相关岗位更是供不应求,薪资待遇直接拉满——字节跳动作为AI领域的头部玩家,给硕士毕业的优质AI人才(含大模型相关方向)开出的月基础工资高达5万—6万元;即便是非“人才计划”的普通应
从ReAct的即时决策,到的全局规划,再到Reflexion与的自我进化,Agent 设计模式正朝着更自主、更可靠的方向发展。简单任务首选ReAct(成本低、速度快)。复杂工作流采用(可控性强)。高可靠性需求场景(如代码、事实问答)务必引入Reflection机制。未来的 Agent 架构将是这些模式的混合体:一个具备长期记忆(Reflexion)、能全局规划(Plan-and-Execute)、
本文分析了知乎上60个关于AI Agent开发痛点与解法的回答,总结出15大技术瓶颈及12大社区共识方案。上下文管理、工具调用不可靠、任务规划脆弱等是主要痛点,而模块化设计、记忆优化、垂直领域聚焦等是热门解决方案。研究发现,Agent落地存在“方案缺位”问题,尤其在数据管理、多模态感知、安全控制等方面,解决方案热度严重不足,提示工程化程度有待提升,市场尚处早期阶段。产品设计、用户体验相关的痛点如意
模式单个请求重复请求并行执行大上下文领域子智能体✅✅技能✅✅移交✅✅路由器✅✅✅。
本文深入探讨了如何利用微调技术提升LLM构建产品的性能,重点介绍了强化微调(RFT)与GRPO算法。通过对比SFT与RFT,强调了RFT在试错中学习的重要性。详细解析了GRPO原理,以及ART框架如何将GRPO应用于复杂Agent,支持工具调用和多轮对话。此外,文章还介绍了RULER技术,它利用LLM作为评判者,无需标注数据即可进行奖励评估,极大简化了微调过程。最后,通过一个完整示例展示了如何使用
摘要:本文介绍了21种智能体设计模式在超强个体OPC(一人公司)中的应用,展示了人机协作如何提升效率和经济效益。通过提示链、路由、并行化等模式,智能体可完成80%-95%的工作,如生成报告、处理客服、优化交易等,而人类只需负责20%以内的审核和决策。每种模式都包含实例、经济效益和实施诀窍,并用人机分工比例饼图直观呈现。这种高度协作的人机互动模式,使一人公司能够以极低成本实现规模化运营,创造巨大商业
这些模式并非一定彼此独立,一些最稳健的生产系统会将它们结合起来。比如,你可能有一个管理器-控制器图(模式 4),协调一个顺序工作流(模式 2),其中一个步骤涉及并行收集信息(模式 3),而最后一个步骤涉及审查器-评判器循环(模式 5)以确保质量。确保稳健的道路始于承认智能体系统中故障不可避免。如果采用这些结构化模式,特别是利用LangGraph实现的基于状态的检查点编排辅助的模式,你可以避免构建脆
人工智能(AI)是让机器模仿人类智能的技术,分为强、弱AI。文章深入浅出解释了机器学习、神经网络、自然语言处理等基础概念,并详细介绍了大模型/LLM、Transformer、参数、训练、推理等核心术语,帮助初学者构建完整的人工智能知识体系,为学习大模型打下坚实基础。
总结来看,通用场景,React 作为最基础的设计模式他的本身其实很简单的,但是因为他每次限定了自己只能执行一个程序,因此他也是比较慢的。因此呢,出现了一些性能优化,比如工具并行执行,但是如果要想保持优化的同时也保留 React 灵活调整的策略,就需要打破每次只能执行一个工具的限制。这也是 Plan & Execute 和 LLM Compiler,所做的事。更进一步呢,如果我们希望工具之间能够进行
本文分享了作者从Cursor转向Claude Code的实践经验,详细介绍了Claude Code的安装步骤、常用指令、实用技巧和省钱方法。内容包括通过AI辅助安装、CC Switch工具配置多模型供应商、解决地区限制问题等实用指南,并重点讲解了/init、/rewind、/plan等核心指令的使用场景。文章还提及了MCP服务和Skills的应用,为读者提供了从入门到进阶的完整学习路径,帮助开发者
摘要:Agent Skills是AI智能体实现场景落地的核心能力,金融领域可分为理解规划、执行操作、交互保障三个层次。不同金融子场景需差异化配置技能组合,如投顾侧重风险校验,客服注重多轮交互。构建可信金融智能体需确保技能可验证、可审计,并深度嵌入业务流程。未来竞争力将取决于技能深度与协同流畅度。同时,大模型技术催生Prompt工程师等新兴岗位,掌握相关技能是把握AI时代机遇的关键。(149字)
智能体资源感知优化:规模化应用的关键能力 文章系统阐述了智能体在具备多种能力后,如何通过资源感知优化解决算力浪费、成本超支和响应延迟等问题。核心内容包括: 资源管理框架:建立对计算、时间、财务三类资源的动态监控与调配机制,实现"效率最大化、成本最小化"的平衡 优化技术体系: 模型层:动态切换、量化蒸馏 工具层:自适应选择、上下文剪枝 调度层:预测分配、并行计算 极端场景:优雅降
所在类方法签名调用时机:在之后立即执行// 刷新 BeanFactory:如果是可刷新的上下文,则销毁原有 BeanFactory,创建新的并加载 Bean 定义// 获取刚刚刷新好的 BeanFactory这个方法虽短,但承担了销毁旧工厂 → 创建新工厂 → 加载 Bean 定义的完整过程,而具体实现则交给子类完成。是获取(或创建)BeanFactory 并加载所有 Bean 定义的关键步骤。它
本文清晰易懂地阐述了Agent和Workflow的区别,适合大模型小白学习。Workflow是显式控制流,而Agent是隐式决策流,由大模型决定。文章通过通俗例子和实战案例,详细介绍了Workflow和Agent的概念、特点、应用场景及代码实现,并对比了二者的核心差异,指导读者如何根据实际需求选择合适的技术方案。一句话总结Workflow = 显式控制流 Agent = 隐式决策流(由大模型决定)