- 文章摘要: 大模型Agent是基于大语言模型的智能执行体,通过自主规划、工具调用和系统集成,实现复杂任务自动化。其核心特性包括自主规划性、工具可拓展性、系统互通性、记忆迭代性和闭环执行性。Agent架构分为五层:基础模型层(推理核心)、核心调度层(流程控制)、工具插件层(能力拓展)、系统集成层(外部对接)和业务应用层(场景落地)。运行机制分为需求解析、任务规划、能力调用等六步闭环流程,支持API插 文章摘要: 大模型Agent是基于大语言模型的智能执行体,通过自主规划、工具调用和系统集成,实现复杂任务自动化。其核心特性包括自主规划性、工具可拓展性、系统互通性、记忆迭代性和闭环执行性。Agent架构分为五层:基础模型层(推理核心)、核心调度层(流程控制)、工具插件层(能力拓展)、系统集成层(外部对接)和业务应用层(场景落地)。运行机制分为需求解析、任务规划、能力调用等六步闭环流程,支持API插
- LangChain 是一套大语言模型 (LLM) 应用开发框架,主打链式编排、任务流程组装,可快速搭建智能对话机器人、智能助手、自动化流程、知识库问答、Agent 智能体。LangChain 支持对接各类在线大模型,包括OpenAI、文心、通义、讯飞等,也支持加载电脑本地的离线大模型。为避免在线大模型带来的大量Token消耗,接下来以离线大模型为例介绍如何搭建LangChain的开发环境。... LangChain 是一套大语言模型 (LLM) 应用开发框架,主打链式编排、任务流程组装,可快速搭建智能对话机器人、智能助手、自动化流程、知识库问答、Agent 智能体。LangChain 支持对接各类在线大模型,包括OpenAI、文心、通义、讯飞等,也支持加载电脑本地的离线大模型。为避免在线大模型带来的大量Token消耗,接下来以离线大模型为例介绍如何搭建LangChain的开发环境。...
- AI缺陷诊断已经不再局限于自动摘要和标签分类。一些工具开始利用日志、指标和调用链定位根因,另一些工具则可以生成修复代码、创建Pull Request,并把测试结果反馈至研发流程。面对定位不同的产品,企业真正需要比较的,不是谁的回答更像专家,而是谁能缩短从问题提交到验证关闭的完整周期。 AI缺陷诊断已经不再局限于自动摘要和标签分类。一些工具开始利用日志、指标和调用链定位根因,另一些工具则可以生成修复代码、创建Pull Request,并把测试结果反馈至研发流程。面对定位不同的产品,企业真正需要比较的,不是谁的回答更像专家,而是谁能缩短从问题提交到验证关闭的完整周期。
- 研发 Agent 的落地不应追求“一步到位”,而应遵循一条更现实的路线:先让 AI 看懂问题,再让它修改代码;先处理明确的缺陷,再参与新需求开发。 研发 Agent 的落地不应追求“一步到位”,而应遵循一条更现实的路线:先让 AI 看懂问题,再让它修改代码;先处理明确的缺陷,再参与新需求开发。
- 本文系统介绍了大模型落地的三大关键技术:全量微调、LoRA轻量化微调和模型量化。全量微调通过更新所有模型参数实现业务适配,但计算成本高;LoRA通过冻结原有权重、仅训练低秩矩阵,显著降低训练成本;模型量化则通过降低参数精度来优化部署效率。三者协同形成完整的大模型落地闭环:微调优化能力,LoRA降低训练门槛,量化提升部署性能。文章详细阐述了各项技术的原理、实施流程和应用场景,并通过代码示例展示了Lo 本文系统介绍了大模型落地的三大关键技术:全量微调、LoRA轻量化微调和模型量化。全量微调通过更新所有模型参数实现业务适配,但计算成本高;LoRA通过冻结原有权重、仅训练低秩矩阵,显著降低训练成本;模型量化则通过降低参数精度来优化部署效率。三者协同形成完整的大模型落地闭环:微调优化能力,LoRA降低训练门槛,量化提升部署性能。文章详细阐述了各项技术的原理、实施流程和应用场景,并通过代码示例展示了Lo
- 本文系统介绍了大模型智能体的核心概念与五大核心能力。智能体是基于大模型构建的、具备自主决策和执行能力的数字实体,通过规划、记忆、工具调用、反思和多智能体协同五大能力实现复杂任务处理。与普通大模型相比,智能体具有主动执行、工具调用和经验迭代的优势。规划能力是智能体的"大脑",负责任务拆解和策略制定;记忆能力存储和复用历史信息;工具调用能力扩展智能体的功能边界;反思能力支持自我优化 本文系统介绍了大模型智能体的核心概念与五大核心能力。智能体是基于大模型构建的、具备自主决策和执行能力的数字实体,通过规划、记忆、工具调用、反思和多智能体协同五大能力实现复杂任务处理。与普通大模型相比,智能体具有主动执行、工具调用和经验迭代的优势。规划能力是智能体的"大脑",负责任务拆解和策略制定;记忆能力存储和复用历史信息;工具调用能力扩展智能体的功能边界;反思能力支持自我优化
- AI 研发管理平台的价值,已经不只是帮助员工写需求、总结任务或生成代码,而是让 AI 在权限可控的前提下获得需求、缺陷、代码和测试上下文,参与真实研发流程。本文建立六维能力模型,对比 9 款相关平台,并给出不同企业的选型与 POC 建议。 AI 研发管理平台的价值,已经不只是帮助员工写需求、总结任务或生成代码,而是让 AI 在权限可控的前提下获得需求、缺陷、代码和测试上下文,参与真实研发流程。本文建立六维能力模型,对比 9 款相关平台,并给出不同企业的选型与 POC 建议。
- 研发团队引入 AI 后,工程师写代码的速度可能明显提升,但产品交付周期未必同步缩短。原因在于,代码生成只是研发流程中的一个环节。真正的组织级提效,需要让 AI 从辅助个人编码,逐步走向独立执行任务,并最终进入工单、缺陷、需求和测试等团队协作流程。 研发团队引入 AI 后,工程师写代码的速度可能明显提升,但产品交付周期未必同步缩短。原因在于,代码生成只是研发流程中的一个环节。真正的组织级提效,需要让 AI 从辅助个人编码,逐步走向独立执行任务,并最终进入工单、缺陷、需求和测试等团队协作流程。
- 摘要: AI智能体通过Workflow多步骤任务编排弥补了大模型单次调用的局限性(上下文有限、无规划性),实现复杂任务的自动化执行。其核心在于将模糊需求拆解为有序子任务,结合状态机与大模型动态决策,形成“规则兜底+智能微调”的闭环流程。示例展示了基于腾讯混元大模型的五步工作流(需求预处理→任务拆解→分步执行→结果校验→整合输出),验证了智能体在连贯执行、上下文记忆及异常处理上的优势。Workflo 摘要: AI智能体通过Workflow多步骤任务编排弥补了大模型单次调用的局限性(上下文有限、无规划性),实现复杂任务的自动化执行。其核心在于将模糊需求拆解为有序子任务,结合状态机与大模型动态决策,形成“规则兜底+智能微调”的闭环流程。示例展示了基于腾讯混元大模型的五步工作流(需求预处理→任务拆解→分步执行→结果校验→整合输出),验证了智能体在连贯执行、上下文记忆及异常处理上的优势。Workflo
- 之前的系列文章主要讲解上下文(提示词)和RAG(知识库),为了方便大家归纳,这里把前面的几个重要内容重新梳理总结。一、搭建应用开发环境正所谓磨刀不误砍柴工,要想后续顺利进行AI应用编程,务必正确搭建电脑的Python开发环境,这样可以避免代码编译时出现奇奇怪怪的错误,才能心无旁骛地钻研AI应用技能。首先是安装哪个Python版本。AI开发环境的Python版本推荐Python 3.10.x... 之前的系列文章主要讲解上下文(提示词)和RAG(知识库),为了方便大家归纳,这里把前面的几个重要内容重新梳理总结。一、搭建应用开发环境正所谓磨刀不误砍柴工,要想后续顺利进行AI应用编程,务必正确搭建电脑的Python开发环境,这样可以避免代码编译时出现奇奇怪怪的错误,才能心无旁骛地钻研AI应用技能。首先是安装哪个Python版本。AI开发环境的Python版本推荐Python 3.10.x...
- 上一篇文章介绍了如何从TXT文件读取文本信息,可是日常办公很少使用纯文本的TXT格式,而采用专业的PDF格式或者WORD格式,有时还需要通过网页抓取知识。接下来就介绍如何从PDF、WORD、HTML等文件中读取文本内容。一、从PDF文件读取文本PDF是一种常用的文档格式,常用于只读的通知文件,或者电子版书籍。Python提供了多种三方库用来解析PDF文件,其中pdfplumber较常用。使... 上一篇文章介绍了如何从TXT文件读取文本信息,可是日常办公很少使用纯文本的TXT格式,而采用专业的PDF格式或者WORD格式,有时还需要通过网页抓取知识。接下来就介绍如何从PDF、WORD、HTML等文件中读取文本内容。一、从PDF文件读取文本PDF是一种常用的文档格式,常用于只读的通知文件,或者电子版书籍。Python提供了多种三方库用来解析PDF文件,其中pdfplumber较常用。使...
- 前面的文章在构建RAG并检索时,既使用了国外大模型,也使用了国内大模型;既运用了内存向量检索库FAISS,也运用了磁盘向量数据库Chroma。但知识库的原始来源却是knowledge数组,这与现实场合有所出入,因为实际资料都保存在TXT、PDF、WORD等格式的文档中,甚至来自互联网上的HTML网页,于是RAG的前置条件就成了如何从这些文档中提取文本信息。一、读取TXT文件中的文本TXT文件... 前面的文章在构建RAG并检索时,既使用了国外大模型,也使用了国内大模型;既运用了内存向量检索库FAISS,也运用了磁盘向量数据库Chroma。但知识库的原始来源却是knowledge数组,这与现实场合有所出入,因为实际资料都保存在TXT、PDF、WORD等格式的文档中,甚至来自互联网上的HTML网页,于是RAG的前置条件就成了如何从这些文档中提取文本信息。一、读取TXT文件中的文本TXT文件...
- 本文对比了Qwen3-32B和ChatGLM3-6B两款本地部署大模型在高血压风险筛查医疗场景的实战表现。通过搭建OpenAI兼容API服务,使用相同的患者数据和提示词模板进行测试,发现32B大模型在精准度、规则理解、知识储备等方面显著优于6B小模型。Qwen3-32B通过4bit量化技术可在RTX4090显卡运行,能精准识别高血压高危因素并给出专业判定依据;而ChatGLM3-6B存在严重漏判和 本文对比了Qwen3-32B和ChatGLM3-6B两款本地部署大模型在高血压风险筛查医疗场景的实战表现。通过搭建OpenAI兼容API服务,使用相同的患者数据和提示词模板进行测试,发现32B大模型在精准度、规则理解、知识储备等方面显著优于6B小模型。Qwen3-32B通过4bit量化技术可在RTX4090显卡运行,能精准识别高血压高危因素并给出专业判定依据;而ChatGLM3-6B存在严重漏判和
- AI 编程工具正在进入真实研发流程,但 AI 生成代码并不等于可直接交付的代码。它可能提升编码效率,也可能引入业务偏差、安全漏洞、依赖风险和责任模糊。企业要真正用好 AI 写代码,关键不是简单放开或禁止,而是建立代码评审、安全测试和责任边界机制。 AI 编程工具正在进入真实研发流程,但 AI 生成代码并不等于可直接交付的代码。它可能提升编码效率,也可能引入业务偏差、安全漏洞、依赖风险和责任模糊。企业要真正用好 AI 写代码,关键不是简单放开或禁止,而是建立代码评审、安全测试和责任边界机制。
- 本文介绍了一个基于ChatGLM3-6B大模型的本地化部署方案,采用FastAPI后端和Web前端实现完整对话系统。项目特点包括:1)适配RTX4090显卡,支持FP16半精度推理,显存占用优化;2)提供两种推理模式(一次性返回和SSE流式输出);3)内置完善监控系统,实时采集显存、Token生成速度等指标;4)兼容OpenAI API标准接口;5)包含可视化前端界面。系统采用四层架构设计,包含前 本文介绍了一个基于ChatGLM3-6B大模型的本地化部署方案,采用FastAPI后端和Web前端实现完整对话系统。项目特点包括:1)适配RTX4090显卡,支持FP16半精度推理,显存占用优化;2)提供两种推理模式(一次性返回和SSE流式输出);3)内置完善监控系统,实时采集显存、Token生成速度等指标;4)兼容OpenAI API标准接口;5)包含可视化前端界面。系统采用四层架构设计,包含前
上滑加载中
推荐直播
-
用码道,让你的AI作品三步上朋友圈2026/08/04 周二 19:00-20:00
林华鼎-华为云AI开发者运营负责人
从入门 · 到做AI应用 · 到企业级开发。不教编程,只教用AI · 零代码、有产出、能带走、可炫耀 · 每课人人动手实操
回顾中 -
华为云码道Agent集成与鸿蒙实战2026/08/11 周二 19:00-21:00
王一男-华为云码道产品规划专家;李炎-华为云码道产品专家;彭江敏-华为云鸿蒙端云一体化开发专家
本次直播带你解读华为云码道7月份产品新特性、新功能。更有专家演示码道Agent Space × 钉钉机器集成实战,从0到1打通消息通道;码道鸿蒙端云一体化实战,快速搭建员工签到系统。
回顾中 -
基于华为云码道,构建你的定制化AI搭子2026/08/14 周五 09:00-11:30
明亮-华为云开发者发展与支持部部长
本期直播将向您全面介绍华为云码道产品,并基于码道手把手教你部署自己的定制化AI陪伴搭子。
回顾中
热门标签