Python API
Machine learning
The Python-visible autograd, loss, module, optimizer, neural-network, and training surface.
oa.ml
Functions
Bce(a, b)BceBwd(a, b)CrossEntropy(logits, targets)Cross-entropy loss for classification
CrossEntropyBwd(logits, targets)Cross-entropy backward: gradient w.r.t. logits
GradEnabled()IsEnabled()L1(a, b)L1Bwd(a, b)MakeMuonAdamWOptimizer(model, config)Build official Muon+AdamW composite (Muon on 2D body, AdamW on embed/head/1D)
Mse(a, b)MseBwd(a, b)SetEnabled(...)SetGradEnabled(...)SmoothL1(a, b)SmoothL1Bwd(a, b)Classes
GradientTape4 members
__init__(...)Backward(root)Reverse-mode autodiff from scalar loss root
__enter__(...)__exit__(...)OaAdam3 members
__init__(params, lr, beta1, beta2, eps)Step(...)ZeroGrad(...)OaAdamW3 members
__init__(params, lr, beta1, beta2, eps, weight_decay)AdamW optimizer (decoupled weight decay)
Step(...)Apply one optimizer step (update weights)
ZeroGrad(...)Zero all parameter gradients
OaByteEmbedding2 members
__init__(...)DModel(...)OaCallback0 members
OaCbProgressBar2 members
__init__(...)AddMetric(metric)OaCbSummary1 members
__init__(...)OaCbTraining5 members
OnTrainBegin(...)OnEpochBegin(...)OnStepEnd(...)OnEpochEnd(...)OnTrainEnd(...)OaEmbedding5 members
__init__(...)Forward(input)Forward pass: lookup embeddings for each token index
Parameters(...)Get trainable parameters [embed weight]
NumEmbeddings(...)EmbeddingDim(...)OaEmpyrealmCore1 members
__init__(...)OaGpuTimingStats6 members
Count(...)MeanMs(...)MinMs(...)MedianMs(...)P95Ms(...)LastMs(...)OaGru4 members
__init__(...)InputSize(...)HiddenSize(...)NumLayers(...)OaItTraining27 members
__init__(optimizer, config)IsDone(...)Next(...)Next(loss)Reset(...)Index(...)RecordLoss(loss)RecordAccuracy(accuracy)Finish(...)AddCallback(callback)AddMetric(metric)StepCount(...)TotalSteps(...)Epoch(...)StepInEpoch(...)TotalEpochs(...)LiveLoss(...)LastLoss(...)LiveAccuracy(...)ElapsedSeconds(...)LastGpuMs(...)GpuTimingStats(...)Exact GPU per-step timing (mean/min/median/p95/last ms)
WallMsPerStep(...)WallSamplesPerSecond(...)GpuSamplesPerSecond(...)WallUnitsPerSecond(...)GpuUnitsPerSecond(...)OaItTrainingConfig6 members
__init__(...)TotalSteps(...)StepsPerEpoch(...)BatchSize(...)SequenceLength(...)SequenceUnit(...)OaLayerNorm1 members
__init__(...)OaLinear4 members
__init__(...)Forward(input)Forward pass: Out = Input @ W.T + b
SetActivation(activation)Set activation function (None, Relu, Gelu)
Parameters(...)Get trainable parameters [weight, bias]
OaMamba3Module1 members
__init__(...)OaMetric3 members
Name(...)Result(...)Reset(...)OaMetricAccuracy1 members
__init__(...)OaMetricLoss1 members
__init__(name)OaModule8 members
Forward(input)Parameters(...)Get direct parameters only. Use AllParameterPtrs for nested modules.
AllParameterPtrs(...)Get recursive trainable parameter pointers.
NumParameters(...)SetName(...)GetName(...)Save(path)Serialize module parameters to an .oam file
Load(path)Load module parameters from an .oam file
OaMuon3 members
__init__(params, lr, beta, weight_decay, eps, ns5_iters)Muon optimizer (2D hidden matrices)
Step(...)ZeroGrad(...)OaMuonAdamWConfig11 members
__init__(...)MuonLr(...)AdamWLr(...)MuonBeta(...)MuonWeightDecay(...)MuonEps(...)MuonNs5Iters(...)AdamWBeta1(...)AdamWBeta2(...)AdamWEps(...)AdamWWeightDecay(...)OaOptimizer6 members
Step(...)ZeroGrad(...)SetLr(lr)Lr(...)GetLr(...)GetStep(...)OaOptimizerComposite3 members
__init__(...)Step(...)ZeroGrad(...)OaOptimizerNoOp1 members
__init__(...)OaParameter4 members
Name(...)Data(...)Grad(...)RequiresGrad(...)OaRnn4 members
__init__(...)InputSize(...)HiddenSize(...)NumLayers(...)OaSGD3 members
__init__(params, lr, momentum, weight_decay)Step(...)ZeroGrad(...)OaTransformerBlock2 members
__init__(...)SetSeqLen(seq_len)Update the runtime sequence length without replacing model weights
Enums
OaActivationSource None · Relu · Gelu