学习资料 全部文章

浏览 学习资料 分类下的公开文章、摘要与延伸阅读。肖恩子的知识花园

分类:学习资料排序:发表时间倒序
增长黑客中文
15

增长黑客

学习资料
作者: 范冰
发表时间

《增长黑客》开源全文系统梳理创业公司从产品验证、获客到留存变现和病毒传播的增长方法,核心结论是数据驱动、实验验证与产品驱动增长仍有效,现仅授权非商业阅读与分享。

前线部署工程师中文
12

前线部署工程师

学习资料
作者: 范冰
发表时间

《前线部署工程师》提出FDE通过识别业务问题、客户获取、部署激活、续约扩收与规模复制,将AI模型嵌入真实流程并量化价值,是破解企业AI落地失败、弥合技术与商业价值鸿沟的关键岗位方法论。

深入理解 AI Agent:设计原理与工程实践中文
23

深入理解 AI Agent:设计原理与工程实践

学习资料
作者: 李博杰
发表时间

开源书《深入理解AI Agent》系统解决AI Agent从原理到工程落地的学习与实践问题,提供10章内容、10种语言版本及94个实验代码,降低开发者构建、评估和扩展Agent的门槛。

cs249r_book:机器学习系统教程中文
19

cs249r_book:机器学习系统教程

学习资料
作者: harvard
发表时间

该ML系统教育项目整合教科书、TinyTorch、MLSys·im、硬件套件与教学资源,构建从阅读到部署的学习闭环,旨在弥合AI构建与工程化落地差距,dev分支正拆分两卷内容,并通过分层许可支持教学、开源与受限商用。

面向长周期任务的适配智能学习体上下文管理中文
43

面向长周期任务的适配智能学习体上下文管理

学习资料
作者: Lu Yi等
发表时间

AdaCoM用外部小型LLM为冻结Agent学习上下文删改、合并与压缩策略,缓解长任务中的上下文退化,无需训练闭源Agent;实验显示网页搜索平均相对提升39.0%,深度研究中Kimi、DeepSeek分别提升9.0%和22.3%,核心结论是强Agent适合保留较长高保真上下文,弱Agent需激进压缩,且策略可在能力相近Agent间迁移复用。

从零训练大语言模型中文
39

从零训练大语言模型

学习资料
作者: FareedKhan
发表时间

教程用PyTorch从零复现Transformer语言模型,覆盖The Pile数据下载、预处理、训练、生成与代码解析,支持1300万至20亿参数规模;项目模块化实现MLP、自注意力、因果掩码、Transformer块、嵌入和位置编码,并给出GPU显存与可训练规模参考。

语言模型需要“睡眠”吗?借助离线循环机制优化在线推理中文
31

语言模型需要“睡眠”吗?借助离线循环机制优化在线推理

学习资料
作者: Sangyun Lee等
发表时间

LLM Sleep提出在上下文窗口满后暂停输入,执行多次离线递归前向传播,用学习规则更新SSM快速权重,再清空KV缓存继续预测;其核心判断是长上下文失败主要源于被驱逐信息缺乏足够计算转化,而非内存容量不足。实验显示睡眠循环越多,Rule 110、Depo多跳检索、GSM-Infinite和滑动窗口任务的深度推理表现越好,收益集中在难例;代价是训练成本随循环深度线性上升且更不稳定。

agents-towards-production:GenAI智能体的完整技术栈教程中文
54

agents-towards-production:GenAI智能体的完整技术栈教程

学习资料
作者: NirDiamant
发表时间

该开源仓库提供28个可运行生产级GenAI智能体教程,覆盖编排、RAG、记忆、工具集成、部署、多智能体协作、GPU扩展、安全护栏与可观测性,配套两本技术书籍,是包含从原型到企业级落地的技术手册。

创始人手册:打造原生人工智能初创企业中文
61

创始人手册:打造原生人工智能初创企业

学习资料
作者: Anthropic
发表时间

AI正把创始人从亲自执行者推向Agent编排者,使非技术创始人也能交付生产级应用,10人独角兽具备可规划性。创业路径被重构为四阶段:Idea先验证问题与假设,MVP用最小产品、持久上下文和安全审查证明需求,Launch把牵引力转为可重复增长并系统化运营,Scale依靠领域深度、数据飞轮和工作流锁定构建护城河。AI降低了构建成本,但原型不等于验证,长期优势来自判断力、编排能力与可积累资产。

从零构建大型语言模型中文
65

从零构建大型语言模型

学习资料
作者: Sebastian Raschka
发表时间

《Build a Large Language Model (From Scratch)》官方代码库提供从零实现GPT类LLM的完整教学代码,覆盖数据处理、注意力、预训练、分类微调、指令微调与推理,采用纯PyTorch、可在普通笔记本运行,并扩展Llama、Qwen、Gemma、MoE等架构,配套视频、自测、Docker、答疑及推理模型续作资源。

每页显示 34
上一页 1 / 4 下一页