登录社区云,与社区用户共同成长
邀请您加入社区
周一:拆Claude Code源码,讲循环。周二:聊DeepSeek涨价,讲Agent本地化迁移的坑。周三:谈MCP协议,提出“螺旋总线”架构。周末:居然去证黎曼猜想,聊湍流和DNA。有人问:博主是不是被AI搞疯了,从工程跳到数学物理?其实,我是在用螺旋生成论(SGT)这套框架,给这周的“Agent工程化三部曲”找一个几何底层。今天,我把这层窗户纸捅破。本周的“螺旋Agent周”到此结束。从的代码
本文详细解析了从零开始掌握PyTorch的五个核心实操方法,涵盖预训练模型调用、高层封装库使用、可视化监控、自动微分机制以及模型跨平台部署。通过丰富的代码示例和具体场景分析,帮助开发者快速构建深度学习项目,解决工程落地中的实际问题。
Qwen3-ASR 从 PyTorch 路径迁移到 vLLM 路径,本质上是一次从“模型调用”到“推理服务”的改造。PyTorch 路径并没有失去价值。模型功能验证算法调试小规模单路识别故障回滚长期在线服务多请求调度中长音频并发转写流式识别标准化API接入在部分信创环境中,厂商对 vLLM 路径提供了更完整的镜像、插件、模型案例和调优参数,因此同一个 Qwen3-ASR 模型通过 vLLM 运行时
本文介绍了Typora插件开发和用电行为异常检测两大技术实践。Typora插件开发部分详细讲解了如何将简洁编辑器扩展为个性化"写作IDE",包括开发环境搭建、核心API、实战案例(智能代码片段管理器)以及进阶技巧,帮助开发者打造专属写作环境。用电行为异常检测部分则基于PyTorch和β-VAE模型,从智能电表数据中识别窃电、表计故障等异常行为,显著降低误报率并提升检出率,提供了从特征工程到部署的全
在本章的目标就是快速搭建一个模型,能够推理即可,之后再自己手写组件。
本文介绍了一个基于PyQt5的本地化AI智能助手工具,集成了Qwen3-ASR语音识别和Ollama大语言模型。该应用采用多线程架构实现语音转文字、本地模型调用和结果展示功能,主要特点包括:1)支持多种音频格式和多语言识别;2)可连接本地Ollama服务进行文本处理;3)提供直观的GUI界面操作;4)完全本地运行确保数据隐私。系统具备设备自适应、流式响应和错误处理等关键技术特性,适用于会议记录、多
摘要:Hugging Face的pipeline模块简化了transformers库的模型调用流程,提供端到端的API支持多种任务(如情感分析、命名实体识别等)。通过示例展示了情感分类任务的使用方法,包括自定义模型下载路径、中英文文本处理效果对比及批处理推理。虽然默认模型对中文处理效果有限,但展现了pipeline在不同模态任务中的便捷性。表格详细列出了支持的跨模态任务类型,体现了该工具在NLP、
本文主要介绍了Agent学习路径中OpenAI和LangChain两大框架的基础知识与应用。首先详细讲解了OpenAI API的使用方法,包括环境配置、模型调用、流式输出等操作实例。接着系统阐述了LangChain的核心概念,包括模型调用、提示词工程(零样本/少样本学习)、文档加载、向量转换、RAG技术等关键组件。文章通过大量代码示例展示了如何利用LangChain构建基于大语言模型的应用,包括聊
本文是程序员转行学习AI大模型的第11篇笔记,主要介绍了首次调用AI大模型的完整流程。内容包括:获取API密钥和基础URL、配置环境变量、选择模型名称等关键步骤,并提供了可直接运行的Python代码示例。文章详细说明了OpenAI客户端的使用方法、必需参数和常用可选参数(如temperature)的设置技巧,帮助开发者快速上手AI大模型调用。适合正在从零开始构建AI知识体系的开发者参考学习。
Hugging Face Transformers库中的Pipeline功能将复杂模型调用简化为简单API,支持多种AI任务。它包含预处理、模型和后处理三个核心组件,支持文本、语音、图像和多模态任务。用户可指定模型、批量处理数据,并通过参数优化性能。Pipeline支持batching加速(GPU环境下可达13倍性能提升),但需注意序列长度差异可能导致内存问题。对于单输入多forward任务,Pi
模型协同工作的实现机制涉及多层次的深度协作。表面通过编程框架API(如Hugging Face)加载配置和权重,中间层由推理引擎(如vLLM)进行内存管理和任务调度,底层则依赖硬件加速(如CUDA核心)和系统优化(如DualPath技术)。这种分层架构从软件调度到硬件执行,通过精细的内存管理、并行计算和网络优化,实现高效模型推理,远非简单API调用可比。
这篇博客详细介绍了浮点数在计算机中的存储方式、不同类型的浮点精度(如FP16、FP32、FP64等)及其用途,以及在深度学习和大模型训练中采用的混合精度训练方法。文章通过理论解释和实例展示,阐述了如何在提高计算效率和节约内存使用的同时,保持数值计算的精度和稳定性。