← 返回首页

十派的玩具箱有哪些内容?

顾名思义,玩具箱就应该是玩具箱。

知识笔记、工具笔记、写出的小玩意儿,都是玩具。

有时候玩玩具是为了写blog,有时候写blog是为了玩玩具。

任何批评和建议均会受到最热烈的欢迎: Issues / pipipi2328@gmail.com

各种工具介绍

主要集中于深度学习常用的工具。

一个最简 Coding Agent 的完整解剖

结合 pi 的架构与真实会话数据(sessions.jsonl),把消息模型、主循环、Provider 层、工具层、会话管理、权限安全和扩展机制逐块拆开讲,配了三张可展开收起的交互式架构图。

Linux 好用的指令

是一些个人觉得UNIX特别干净漂亮的指令。

WanDB

是一个用于监测训练实验的包和网站。

einops

是把Tensor的各种变形操作变得直观的包。

好玩的玩具们

写的奇怪的小玩意儿。

DSH 上线之后我做的几个小工具

是便签/升级版新会话按钮/窗口最小化和弹出的快捷键工具。

AnotherTODO:把待办留在终端,也留在自己手里

是一个本地优先的终端待办:一行输入、TUI 管理、提醒 hook 与私有 Git 同步。

notegotya

是一个用来练习五线谱识谱的小玩具。

贴贴棋

是一个带翻转规则的类黑白棋小游戏。

freshdan

是复旦大学新生指南,讲解许多对新生可能有用的内容。

用 pilog 搭建像素风博客

是搭建这个博客本身的 pilog 静态博客生成器的介绍。

Harness

一些和 Harness 相关的记录。

DSH 有可能覆盖丢失你自己改的文件,记得修一下

是一次 DSH 助手整体重写覆盖文件的复盘,以及把教训固化成写入规则的过程。

翻译和转载的文章

有时还会翻译或转载一些我觉得很有趣的内容。

陶哲轩的职业建议

机器学习系统课程中文翻译

You and Your Research - Richard Hamming

深度学习必将拥有一套科学理论

是学习理论论文《There Will Be a Scientific Theory of Deep Learning》的中文翻译和阅读导览。

CS336

搭建起比较现代的Transformer训练循环,进行实验。

Assignment 1 前半段

Assignment 1 后半段

为此单独写了一些知识性的专题,当然也包括之前的“各种工具介绍”。

估算Transformer模型参数量

估算AdamW训练内存和计算量

从SGD到AdamW,优化器怎么发展过来的?

原始softmax、数值稳定的softmax和在线softmax

结合nanovllm的FlashAttention和PagedAttention主要原理概述

大模型训练

一些训练和开源相关的记录。

双卡 5090 训练 Qwen3-0.6B:从数学推理到 Agentic RL

TRL 1.9.2 会“假装训练”的 bug

给 tensorzero 提的第一个 PR

数据结构与算法

总计三套笔记:算法设计与分析(算法导论),洛谷基础篇,LeetCode HOT 100。

算法课-数学部分

算法课-算法部分

洛谷基础篇

LeetCode HOT 100的前50

LeetCode HOT 100的后50

minitorch

一个有趣的手写简易版PyTorch的项目。 基于Python基础语法、或Numpy、或Numba、或CUDA,编写一个符合接口的迷你版PyTorch。 有CS61A前置(现代Python)和一点人工智能基础知识就能写。

MiniTorch

CSAPP

复旦大学软件工程专业的ICS课程lab,基本与CMU原版保持一致。

Shelllab

Cachelab

Attacklab

Bomblab

Datalab

为了辅助Datalab的讲解,单独编写了介绍浮点数的 ieee754

CS61A 2024 summer

只记录了Discussion(disc)部分的笔记: 因为这一部分难度适中、有东西说,相关的笔记也能推广到lab和hw部分w 跳过了不感兴趣的SQL和scheme部分。

disc07 树、链表

disc05 迭代、时空复杂度

disc04 树的递归

disc03 递归

disc02 高阶函数

disc01 迭代与抽象

封面是 夏夜将终乐队夏夜将终 OFFICIAL SITE)的一次演出。这个乐队是因为ヨルシカ(Yorushika)结成的校园乐队。
未知领域

评论