登录社区云,与社区用户共同成长
邀请您加入社区
作为数据科学家,你可能已经掌握了构建机器学习模型的能力,但真正能发挥价值的是模型部署之后的应用。如果你希望深入了解机器学习模型的部署流程,这份指南将为你提供全面指导。构建和部署机器学习模型的流程通常包括以下几个步骤:构建模型、创建用于提供预测的 API、将 API 容器化,以及部署到云端。
文章介绍了智能体(Agent)的基本概念和特征。通俗地说,智能体是能自主感知环境、决策和执行任务的智能系统,如语音助手、无人车等。专业角度上,智能体是具备环境感知-决策规划-行动执行闭环能力的自治系统,具有自治性、反应性、主动性、社会性和进化性等特征。智能体技术是当前大模型应用的重要发展方向,值得深入学习与收藏。
本文详细介绍了如何使用FastAPI框架构建大模型聚合服务,通过集成DeepSeek和Qwen两大主流大模型实现统一API调用。内容涵盖FastAPI框架优势、API Key获取、环境变量配置、依赖库安装及核心代码实现,帮助开发者高效构建自己的大语言模型服务,提升开发效率和应用灵活性。
本文系统介绍大语言模型(LLM)的核心概念、技术架构与应用场景。详解Transformer架构的自注意力机制,对比GPT(解码器)与BERT(编码器)的差异,阐述预训练与微调流程,解释Token处理机制。大模型通过自监督学习掌握语言规律,在文本生成、理解等任务表现卓越。最后介绍智泊AI的AI培训课程,帮助学员掌握大模型技术,成为企业刚需的AI人才。
clone代码。
FastAPI-MCP是一个开源工具,可将FastAPI应用端点以MCP工具形式暴露并支持身份验证。作为原生扩展,它无需额外转换即可高效通信;零配置部署简单集成;保留完整文档和架构;支持安全灵活部署。适合需要快速启用MCP功能的FastAPI开发者,尤其对安全性、灵活性和效率有要求的团队。
本文解析大模型参数的本质(神经网络中的权重和偏置)、来源(通过训练数据"学习"获得)及其规模的重要性。参数数量影响模型容量、表现力和能力门槛,但也带来高昂计算成本。虽然参数越多AI通常越聪明,但业界正探索参数与能力间的最佳平衡点,以实现更高效的AI系统。
摘要:本项目基于Python技术栈(Flask/FastAPI+PaddleHub)与Vue+ElementUI前端,构建新闻长文本10分类系统,支持Web与QT双端应用。系统针对新闻平台人工分类效率低的问题,通过PaddleHub预训练模型实现高效自动化分类,提供单条/批量预测功能。采用前后端分离架构,后端FastAPI提供API服务,前端Vue实现交互界面,QT端扩展桌面应用场景。项目具备开源
工具检索系统是一个基于向量数据库和多种检索算法的工具管理平台,旨在提供高效的工具存储、检索和管理功能。系统支持工具的增删改查操作,并提供了多种检索方法,包括稠密检索、稀疏检索、关键词检索和混合检索,以满足不同场景下的工具检索需求。系统支持自定义检索方法,可以通过以下步骤添加新的检索方法:在中的类中添加新的检索方法在函数中添加对新方法的支持更新API接口文档,说明新方法的参数和用法系统支持自定义混合
【摘要】基于PaddleHub+FastAPI+Vue技术栈开发了一套新闻长文本10分类系统,支持Web和QT双端应用。该系统采用前后端分离架构,后端使用FastAPI调用PaddleHub预训练模型实现文本分类,前端通过Vue+ElementUI构建交互界面,同时提供QT客户端版本。功能包括单条新闻实时分类和批量Excel文件处理,可应用于毕设案例、媒体内容审核及信息检索等场景。项目完全开源,部
在这篇指南中,你将学习如何将 LangGraph 工作流封装在 FastAPI 中,变成一个生产就绪的 endpoint。
你想精通多国语言吗?借助本地大模型,开发一个跨语言翻译系统
别再烧钱做AI!大模型微调GPU终极指南:从入门到放弃?