登录社区云,与社区用户共同成长
邀请您加入社区
摘要 本文记录了作者使用Codex开发Agent完成"博士猫"AI个人知识库MVP的全过程。该项目核心功能包括支持PDF/EPUB/Markdown/Word文档导入,实现中文全文与语义混合检索,并基于检索证据生成带真实引用的回答。项目最终封装为macOS应用。 开发过程中,作者对AI编程的认识经历了三个阶段转变:从最初的"自动生成完整产品"的误解,到发现其作为协作开发伙伴的价值,最终形成"人负责
通过“知识图谱 + 大模型”的融合路线,让沉睡的政策文本变为7×24小时在线的“数字网格员”,让居民享受“服务就在指尖”的便捷,也让基层工作者回归服务本质。
在将训练好的模型部署至昇腾NPU进行推理时,精度对齐是核心挑战。模型的精度损失往往不是单一原因造成,而是贯穿整个跨架构迁移与转换链路中多种因素共同作用的结果。这是一个典型的“查异排错”过程:由于AI训练通常基于GPU/CPU环境,而推理部署在专用的NPU硬件上,二者在硬件架构、软件栈、计算范式上存在系统性差异,任何环节的细微偏差都可能被链路放大,最终导致输出结果与预期不符。导致精度问题的根源错综复
事实上下文:同样是“伤人”,“正当防卫”与“故意伤害”的结果天差地别;法律上下文:同样是“合同无效”,《民法典》第144条(无民事行为能力)与第153条(违反强制性规定)的适用条件完全不同;场景上下文:同样是“继承”,“遗嘱继承”与“法定继承”的优先级逻辑截然相反。传统法律AI的解决方案是“规则硬编码”:人工编写几千条“如果-那么”的逻辑,比如“如果事实包含‘婚前购买’,则适用《民法典》第1063
神经符号AI正在成为能源电力等领域智能化升级的可信技术基石。它通过“感知+推理”的融合架构,不仅提升了系统的准确率,更从根本上解决了AI在关键决策中的“黑盒”难题,实现了决策过程的可解释、可追溯、可审计。
迁移学习,就是把一个已经训练好的模型(比如学会识别猫的神经网络),把它学到的“知识”,应用到另一个不同但相关的任务上(比如识别老虎)。3. 为什么需要迁移学习?在很多专业领域(比如医疗影像分析),我们很难获得海量的、被医生标注好的X光片数据。数据太少,AI很难训练好。但互联网上有海量的、普通的图片数据(比如猫、狗、汽车的图片)。我们可以先用这些海量数据训练一个基础模型,然后把它的知识迁移到医疗影像
本文表明,掩码自编码器(MAE)是一种适用于计算机视觉的可扩展自监督学习方法。我们的 MAE 方法非常简单:对输入图像的随机图像块进行掩码,并重建缺失的像素。该方法基于两个核心设计。首先,我们提出了一种非对称的编码器-解码器架构:编码器仅在可见的图像块子集(不包含掩码标记)上进行操作,同时使用一个轻量级解码器,从潜在表示和掩码标记中重建原始图像。其次,我们发现对输入图像进行高比例掩码(例如 75%
AISBENCH是昇腾平台面向轻量级模型推出的端侧推理工具集,它集成了模型转换、图优化、量化压缩与运行时调度等核心功能。极轻量:内存占用与二进制体积极小,适合嵌入式场景低延迟:优化数据流与算子调度,推理速度更快易用性:提供一键式编译工具,简化部署流程高能效:支持功耗与性能的平衡调节,延长设备续航本文详细介绍了使用AISBENCH在昇腾 NPU 上部署轻量化模型的完整流程,从环境配置到实际推理,提供
T5模型,通过统一的文本到文本转换框架系统探索了NLP迁移学习的各项因素。研究采用标准化的Encoder-Decoder架构,基于清洗后的C4数据集(750GB),通过控制变量实验比较了不同预训练目标、架构、训练策略等对性能的影响。结果显示,去噪目标、全参数微调、增大模型规模等策略效果最佳。最终T5-11B在多个基准测试中达到SOTA,GLUE得分90.3,SuperGLUE得分88.9。论文不仅
上一篇红日初升,其道大光。我们一定都有光明的未来是晚上睡不着的碎碎念,竟然也有很多人看。今天来分享一下用AI编程做出来的小程序,以及制作的思路。
摘要: MIT团队在ICLR 2023提出BrainBERT,通过自监督学习从颅内场电位(SEEG)数据中提取通用神经表征。该方法使用掩码重建策略预训练Transformer模型,支持STFT和Superlet两种时频输入表示,结合自适应掩码和内容感知损失。实验表明,BrainBERT在句子起始检测等4类任务中平均AUC达0.83,较基线提升41%,且仅需150样本即可达到深度网络1000样本的性
传统的垃圾分类主要依赖人工判断,效率低下且容易出错。随着深度学习技术的发展,我们可以使用迁移学习快速构建垃圾分类模型。本项目完整展示了从需求界定到模型部署的AI项目周期,通过迁移学习,成功构建了一个高准确率的垃圾分类识别系统。在实际应用中,可以根据具体需求扩展功能,如收集更多数据、模型优化、实际应用部署等
本文提出了一种基于迁移学习和可解释时频分析的滚动轴承故障诊断方法。首先通过短时傅里叶变换将振动信号转换为时频图像,并采用动态阈值增强故障特征;然后利用预训练的VGG16网络进行迁移学习,在CWRU轴承数据集上实现10种健康状态的高精度识别。为增强模型可信度,引入Grad-CAM热力图可视化决策依据,并设计Faithfulness指标量化解释忠实性。结合故障机理知识和大语言模型自动生成诊断报告,在检
摘要: aivectormemory是一款轻量级开源工具,通过MCP协议为AI助手提供长期记忆功能,解决开发者面临的三大痛点:记忆断层、RAG方案过重和Token成本压力。该工具基于Python开发,支持本地化存储和智能语义检索,无需复杂部署即可实现历史对话的精准调用。用户仅需简单配置即可与Claude Desktop等客户端集成,适用于个人知识管理和项目协作场景。其核心优势在于轻量化设计、隐私保
本文旨在为开发者和AI从业者提供一套完整的迁移学习实践指南,帮助他们在资源受限的环境下构建高性能的AI原生应用。我们将重点讨论如何将大型模型的知识有效迁移到小型模型中,以及如何优化推理流程。文章首先介绍迁移学习的核心概念,然后深入探讨其在提升推理能力方面的具体应用,接着通过实际案例展示实现方法,最后讨论未来发展趋势。迁移学习:将从一个任务中学到的知识应用到另一个相关任务中的机器学习方法AI原生应用
从智能助手自动订机票、写方案,到AI Agent 化身 “数字员工” 完成报告撰写、数据分析全流程,掌握大模型技能的人,正在拉开和同龄人的效率鸿沟。,不仅讲解理论知识,更结合 2025 年最火的 AI Agent、多模态应用等热点,带你掌握最新技术趋势,学的每一招都是职场刚需。从硬件选型到云端部署,从开源模型微调到手写神经网络,老师全程实操演示,让你拥有自己的专属大模型,真正把技术握在手里。因此,
2026年AI人才缺口巨大,高薪岗位等你来! 随着人工智能行业的迅猛发展,AI人才需求激增,大厂如字节、阿里、腾讯为AI人才提供月薪3万-6万的高薪待遇,部分岗位年薪超50万。然而,市场竞争激烈,想要脱颖而出,需掌握核心技术。唐宇迪老师的《人工智能深度学习涨薪就业班》 专为求职者设计,覆盖计算机视觉、大模型开发等前沿技术,提供200+实战案例、30+应用场景,对标大厂P7+水平,助力学员快速入行、
AI原生应用(如智能医疗助手、法律文书分析工具)需要精准识别垂直领域的实体(如“糖尿病”“合同条款”),但直接训练模型需大量标注数据(通常需数万条),而真实场景中企业或开发者往往只有几百条标注样本。本文聚焦“迁移学习”这一技术,帮助你用“借通用模型的力”解决垂直领域实体识别的难题,覆盖从概念理解到实战落地的全流程。本文先通过“学骑自行车→学骑电动车”的生活案例引出迁移学习;再拆解实体识别、迁移学习
与LeNet有相同之处,也有很多区别;比如适用大尺寸的图像所以使用11X11这种大尺寸的卷积核使用Relu激活函数,对比tanh/sigmoid激活函数,训练更快且避免梯度消失dropout随机使得一些神经元失活防止过拟合(用在全连接层)LRN局部归一化:正则项,防止过拟合# input_size还必须是元组,使用列表就会报错,,,,AlexNet中使用了dropout,resnet丢弃dropo
随着人工智能技术的快速发展,AI Agent在各个领域得到了广泛的应用,如智能客服、自动驾驶、游戏竞技等。然而,每个领域都有其独特的特点和数据分布,传统的机器学习方法需要在每个新领域重新训练模型,这不仅耗费大量的时间和资源,而且在数据稀缺的情况下难以取得良好的效果。迁移学习的出现为解决这一问题提供了有效的途径。本文的目的是深入研究迁移学习在AI Agent领域适应中的应用,探讨如何利用迁移学习技术
本文提出了一种面向低成本智能相框的轻量化AI视频生成方案,通过多模态LLM将音频直接转换为连贯的说话视频。核心创新包括:1)3.7B参数时空LLM架构,采用ST-RoPE位置编码实现稳定口型;2)交叉LoRA蒸馏技术,使小模型达到接近14B大模型的表现;3)端侧全INT8优化,在RK3588芯片上实现280ms首帧延迟和25fps稳定输出。最终模型体积仅692MB,口型误差1.9mm,支持45°侧
摘要:本文介绍如何构建生产级AIAgent办公自动化系统,基于ReAct框架和函数调用技术,实现自主操作ERP、邮件处理、报表生成等功能。系统包含任务规划、工具调用、记忆管理等核心模块,通过Python实现。在真实企业场景中,日均处理200+工单,准确率达94%,比传统RPA灵活度提升5倍。文章详细解析了技术架构、工具定义、错误处理等关键技术,并展示了物流企业案例的实际效果。同时提出了API成本控
先用迁移学习,再考虑从头训练:小样本领域任务优先使用预训练网络。冻结+分层 LR 是稳妥策略:在数据不足时保留低层特征稳定性。合理的数据增强是提升泛化的关键。评估不止看整体准确率:关注类别召回/精度,避免模型偏向多数类。监控训练曲线:早停(Early Stopping)防止过拟合。
运动控制算法十年演进(2025-2035) 未来十年,运动控制将从轨迹跟踪演进为物理行为治理的核心。第一阶段(2025-2027)聚焦功能型控制,确保短时稳定性;第二阶段(2027-2030)升级为风险缓冲层,显式建模安全裕度并主动限速;第三阶段(2030-2035)将控制算法转变为"物理宪法",持续评估运动许可并强制风险管控。关键转变在于:从"如何稳定执行"
摘要: 未来十年(2025-2035),语义分割将从单纯的空间标注工具演变为智能系统的“空间认知裁判”,核心在于判断系统能否基于当前语义理解安全行动。演进分为三阶段:功能型(提供像素级分类)、可控型(输出可信度并约束行为)、治理型(成为空间语义的“宪法”,具备否决权)。关键转变是风险意识从隐式到显式,最终解决“分得细≠可依赖”的核心矛盾,确保系统在不确定时主动保守或拒绝行动,避免因误分导致不可逆后
生成式AI是一种能够自主创作内容的人工智能技术,可以生成文本、图像、音乐、代码等原创内容。它基于大语言模型和深度学习,通过模仿人脑思维方式,从海量数据中学习并推演新内容。2022年ChatGPT的推出标志着生成式AI进入爆发期,现已被广泛应用于文案创作、艺术设计、音乐制作、编程辅助、科研模拟等多个领域。尽管存在安全性和伦理风险,但全球企业正加速AI化转型。生成式AI的发展经历了从早期聊天机器人到现
摘要:本文提出一套大模型分布式训练的通信优化体系,通过拓扑感知RingAll-Reduce改进、PowerSGD+EF21混合压缩算法、计算-通信流水线设计等关键技术,在175B参数模型训练中实现显著性能提升。实验表明,该方案将千卡集群的通信耗时占比从68%降至12%,吞吐量提升4.7倍,单卡算力利用率达82%,训练成本降低66%(节省140万美元)。文章详细解析了算法原理、PyTorch实现细节
迁移学习的本质是“站在巨人的肩膀上”——通过复用已有的知识和模型,解决新任务的数据、算力瓶颈。随着大模型(如GPT-4、CLIP)的发展,迁移学习进一步演变为“预训练-微调”(Pre-train & Fine-tune)范式,成为当前AI的主流研发模式。未来,结合自监督学习、多模态迁移等技术,迁移学习将在更多低资源场景中发挥关键作用。
在人工智能领域,AI Agent需要在复杂多变的环境中高效地完成多种任务。传统的机器学习方法通常针对单一任务进行训练,这不仅需要大量的数据和计算资源,而且模型的泛化能力和适应性较差。多任务迁移学习技术旨在解决这些问题,它允许AI Agent在不同任务之间共享知识和经验,从而提高学习效率、减少数据需求,并增强模型在多个任务上的性能。本文的研究范围涵盖了AI Agent多任务迁移学习技术的基本概念、核
摘要: 2015-2025年,模型优化从手工调参(SGD/Adam)演进至智能自进化时代。早期依赖专家经验(2015-2018),中期通过分布式与自动化HPO实现百倍效率提升(2019-2022),2025年进入VLA自优化阶段,融合量子加速与意图级自适应,中国技术(华为、阿里、DeepSeek等)主导创新,优化效率提升万倍,收敛时间从周级缩短至秒级,泛化率超99%。十年间,AI优化从“人工调参”
随着人工智能技术的飞速发展,大语言模型(LLM)如GPT系列、BERT等取得了显著的成果。然而,这些通用的LLM在特定专业领域的应用中往往不能直接满足需求。跨领域AI Agent旨在通过迁移学习的方法,将LLM的能力迁移到不同的专业领域,如医疗、金融、法律等,以提高模型在这些领域的性能和适应性。本文的范围涵盖了从理论基础到实际应用的各个方面,包括核心概念、算法原理、数学模型、项目实战等,旨在为读者
数据同步工具对比与选型指南 本文系统对比了8款主流数据同步工具(DataMover、DataX、Kettle等),从架构设计、功能特性到适用场景进行全面分析。工具可分为四类:开源框架类(如DataX)、传统ETL类(如Kettle)、国产云平台类(如DataMover)和SaaS服务类(如Airbyte)。重点对比了部署架构、数据处理能力、增量同步支持、易用性等核心维度,指出DataMover在图
梯度裁剪是训练的稳定器,防止学习过程因“冲动”而崩溃。迁移学习是知识的接力棒,让AI能够继承前人的智慧,快速适应新领域。多任务学习是能力的催化剂,通过关联任务塑造AI更强大、更通用的理解力。对于初学者,理解这些技巧背后的“为什么”(解决什么问题)和“是什么”(核心思想),远比记忆数学公式和代码细节更重要。当你未来真正开始构建自己的AI项目时,你会知道,在训练遇到瓶颈时,工具箱里有哪些趁手的“法宝”
迁移学习不是黑魔法,它只是把“巨人的肩膀”免费借给你。你不需要 100 张 A100,也不需要 6000 万张图,几张私照 + 一杯咖啡的时间,就能让 AI 学会你的独家记忆。下次老板再拍桌子:“三天给我 1000 张图!然后合上屏幕,去茶水间再续一杯——让 GPU 替你熬夜,你负责梦里数鸡腿。
2025年AI技术已深入生活各个领域。本文系统介绍了人工智能的基础概念、核心技术(机器学习、深度学习、NLP)及主要应用(计算机视觉、语音识别、推荐系统等)。概述了AI系统组成、发展简史和学习路径,并探讨了AI伦理挑战与未来趋势(多模态AI、边缘计算等)。为初学者提供了从编程基础到实践项目的学习建议,帮助快速入门这一快速发展的领域。
《零基础轻松玩转AI:10个趣味实践带你入门》摘要 本文通过10个趣味实践案例,以"玩"的方式带领零基础读者轻松入门AI。从区分AI/ML/DL概念开始,逐步涵盖监督学习、无监督学习、强化学习等核心知识点,最后进阶到CNN图像识别和AIGC内容生成。每个案例都配有≤20行的可执行代码,使用Google Colab即可一键运行,产出包括手写数字识别模型、中文情感分析、二次元头像生
这篇文章不讲长推导、不堆希腊字母,只给新手最需要的“人话版”笔记。读完你能做到:听到“深度学习、过拟合、Transformer”不再发怵;用生活例子把概念讲给爸妈听;知道每个技术最适合干什么活,下个项目选方案不抓瞎。概念不再陌生,场景已经对齐,代码也跑了——你不再是纯小白。人工智能这条路很长,但“理解 10 个核心知识点”是最短也最重要的一公里。
本文为零基础学习者提供10个AI核心知识点和配套实战案例(均≤20行代码),涵盖机器学习基础到生成式AI应用。每个知识点配Google Colab可运行代码,2小时内可完成:1)区分AI/ML/DL概念并调用中文GPT模型;2)实现K-Means聚类;3)拆分评估泰坦尼克数据集;4)可视化过拟合;5)对比损失函数;6)手写梯度下降;7)文本向量化;8)CNN手写数字识别;9)中文情感分析;10)生
《2025 AI技术全景图》摘要:本文系统梳理了人工智能技术体系与发展趋势。1)技术框架:AI作为感知-决策-执行的系统工程,ML包含监督/无监督/强化学习等分支,DL以CNN/RNN/Transformer为核心架构;2)AIGC爆发:从ChatGPT到Sora的演进路径,2025年将实现多模态实时生成;3)实用指南:数据预处理流程、模型选型策略(大/小模型适用场景)、训练推理差异;4)前沿动态
摘要:本文提供AI数学基础速成指南,通过生活化类比和可执行代码,帮助读者快速掌握四大核心领域:1)线性代数(数据向量化及矩阵运算);2)概率论(概率分布与统计特性);3)微积分(梯度下降原理);4)优化方法(SGD及其变种)。重点演示了NumPy实现线性回归和mini-batch SGD,并解析Transformer中的QK^T/√d_k等关键概念。附带可视化工具推荐和工业实践技巧,强调数学作为&
NLP(自然语言处理)是让机器理解、生成和交互人类语言的技术,如输入"我不开心"输出"要听笑话吗?"。核心任务包括分词、分类、生成等,主流模型如BERT、GPT。中文NLP需处理分词难题(如"南京市长江大桥"切分),当前趋势是直接使用预训练模型。从词袋模型到Transformer,NLP技术快速演进,现可通过少量代码实现文本分类等任务。部
本文分享了一个企业级NLP文本分类项目的完整实践,从数据准备到模型部署全流程拆解。针对客服工单优先级分类任务(21万条不平衡数据),对比了小模型ALBERT(F1 0.865)和LLaMA2微调(F1 0.901)方案,最终采用"小模型兜底+大模型异步纠偏"策略。通过动态量化、知识蒸馏等技术将模型压缩至14MB,实现CPU推理18ms,F1 0.856。部署采用Docker+F
AIGC(人工智能生成内容)是利用AI技术自动生成文本、图像、音频等多模态内容的新型生产方式,被称为"第三次内容创作革命"。其核心技术包括Transformer架构、预训练+微调模式和多模态融合。主流模型如GPT-4、DALL·E3、Stable Diffusion等广泛应用于内容创作、设计营销、教育培训等领域。开发者可通过学习Python、Transformer原理及实战项目
把可视化层(createFigure、drawnow)全部剔除,仅保留算法层与数据层,编译为 C++ MEX,可在 STM32H7 上 200 ms 内完成 512×512 寻路。算法从“黑盒路径”变成“彩色蔓延”——开发者可以像播放电影一样,一帧一帧地观察搜索前沿如何扩张、代价如何传播、最终如何回溯出一条最优路径。在自动驾驶、机器人导航、物流 AGV、游戏 AI 等场景里,“最短”已经不是唯一指
本文为AI初学者提供了一份精简知识清单,包含20个核心概念和8周学习路线。内容涵盖机器学习基础(训练集/测试集、特征工程)、深度学习(CNN/RNN/Transformer)以及大模型应用,通过3个代码案例(线性回归、K-Means聚类、MNIST识别)直观展示AI实现过程。作者强调"最小必要知识"理念,指出掌握矩阵运算、概率基础等关键数学概念即可入门,并推荐Python+Py
【摘要】计算机视觉领域论文发表竞争日益激烈,许多研究者面临导师指导不足、选题困难、创新点匮乏等挑战。咕泡科技推出1对1科研辅导服务,汇集500+专家导师资源,提供从选题到发表的全流程指导,帮助学员高效完成高水平论文。服务涵盖AI全领域,采用系统化教学体系,配备专属督学老师,已累计服务5万+学员。适合毕业论文撰写、职场晋升、博士申请等各类需求的研究者。现开放3个免费科研梳理名额,可扫码咨询专家匹配个
本文系统梳理了AI入门的10个核心知识点:1)AI、机器学习和深度学习的关系;2)监督学习的基本原理与应用;3)无监督学习的任务类型;4)特征工程的关键环节;5)模型训练与损失函数的作用;6)优化器的运作机制;7)过拟合与欠拟合的识别与应对;8)数据集的科学划分方法;9)不同任务的评估指标选择;10)必备的AI工具与框架。文章强调构建完整知识框架的重要性,建议从Python基础开始,循序渐进掌握机
本文介绍了在华为昇腾AI处理器上使用MindSpore框架实现混合精度训练(AMP)的方法。通过设置amp_level参数(推荐O2模式),配合LossScale策略,可显著提升训练速度并降低显存占用。文章详细解析了不同精度级别的适用场景,并提供了两种代码实现方案:使用Model高阶接口和函数式编程方式。同时指出了O2模式下可能遇到的Softmax溢出、BatchNorm精度等常见问题及解决方案。
医疗数据科学就像一碗麻辣烫——看似简单,实则复杂。你以为掌握了机器学习算法,却发现医院数据格式比方言还难懂;你以为精通Python,却在处理DICOM医学影像时跪了。但正是这种挑战,让每一次突破都充满成就感。最后想说:如果你也对医疗数据科学感兴趣,建议从《健康医疗数据科学》这类课程入门。记住,不要怕犯错——毕竟连AI都会把"高血压"诊断成"高血庄",更何况人类呢?
迁移学习的灵感源于人类认知的基本规律:孩童在学会数数后,学习加减法会更轻松;厨师掌握中餐烹饪技巧后,钻研西餐时对火候、调味的理解会更快——这种“旧知识助力新知识学习”的能力,正是迁移学习试图赋予AI的核心特质。从学术角度定义,迁移学习是“将从源领域(Source Domain)和源任务(Source Task)中学习到的知识,应用于目标领域(Target Domain)和目标任务(Target T