TensorPlay AI

看懂计算。改造它。

从 Tensor 到 kernel,层层可读。一个面向学习、研究和硬件实验的透明框架。

由张紧结构、计算节点与荧光绿平面组成的 TensorPlay 抽象主视觉

不隐藏计算路径。让每一次前向传播、自动微分与内核执行都可以被阅读、验证和重新组合。

01前向传播
02自动微分
03内核执行

清晰,比魔法更重要。

纯净与透明

从 Python 一路追踪到 C++ 核心。每层抽象都可以被剥开,每个操作都有可读路径。

DIY 加速

CPU 与 CUDA 后端保持简洁,为自定义硬件内核、算子和 nanobind 绑定留出实验空间。

模块化自动微分

TPX 将计算与梯度解耦,让动态图、反向传播与新微分模式更容易理解和修改。

科研就绪

用更少样板代码原型化新网络层、优化器、存储格式、算子融合和静态图捕获。

把黑盒拆成四个动词。

P10

执行计算

纯张量计算引擎。负责内存管理、基础内核、Dispatcher 与跨硬件后端。

TPX

追踪变化

显式自动微分层。沿动态图观察数据、梯度与反向传播的完整路径。

Stax

加速图

静态图优化与 JIT 实验场。用于算子融合、图捕获和计算路径优化。

NN

构建网络

PyTorch 兼容的高层神经网络接口。Linear、Conv2d 等组件也是自定义层的蓝图。

先跑起来。再拆开。

像 PyTorch 官方选择器一样,选择系统、安装方式和计算平台,生成对应命令。

系统
安装方式
语言Python
计算平台
运行命令python3 -m pip install tensorplay --upgrade

从源码内部发来的消息。

从这里继续。

一起把黑盒打开。

学生、开发者、教育者与研究者都可以参与。阅读路线、贡献代码、讨论架构,或订阅项目动态。

Ask DeepWiki