Transformer 架构详解:从 Attention 到大模型
拆解注意力机制、多头自注意力与编码器-解码器结构,讲透 GPT 与 BERT 背后的同一个 Transformer。
搜索全站文章、教程与内容。
共找到 9 条结果
拆解注意力机制、多头自注意力与编码器-解码器结构,讲透 GPT 与 BERT 背后的同一个 Transformer。
从 API 服务到自建推理,用 vLLM 上线大模型服务,掌握 KV Cache、连续批处理与量化三板斧。
把语音、文本生成等系统级 AI 能力接进鸿蒙应用,再走完签名、测试、上架与运营的全流程。
用 PyTorch 搭一个识别手写数字的 CNN,完整走一遍数据加载、模型定义、训练与评估全流程。
Demo 人人会写,产品难在稳定:拆解鉴权、计费、限流、评测与监控,让 AI 应用真正可用。
当 VLM 遇上机械臂与移动底盘:拆解端侧推理、感知-决策-执行闭环与具身智能的落地路径。
为什么微调比从零训练省得多?用 LoRA 冻结原模型、只训练低秩增量,在自己的数据上定制大模型。
大模型正在从“只能读字”走向“能听会看”:梳理视觉、语音、视频模型接入与工具链集成的方法。
让大模型不仅会聊天,还会“动手做事”:理解 Agent 循环,用 Function Calling 搭建第一个智能体。