code wiki / _hdl_build / nx_f32_charlm_train_gate.nx

nx_f32_charlm_train_gate.nx

buildroot/runtime/_hdl_build/nx_f32_charlm_train_gate.nx

20506 B288 linesdepth 4pulls 5 transitivereach 0 importersview sourcekind gate/prooftopic f32
docsdependenciesstructsconstsfunctions

dependencies 4 imports · 0 importers

nx_gate_gn.nx nx_gate_base.nx nx_f32_hw.nx nx_syscalls.nx nx_f32_charlm_train_gate.nx

imports: nx_gate_gn.nxnx_gate_base.nxnx_f32_hw.nxnx_syscalls.nx

imported by: nobody (leaf or entry point)

call flow from main pre-order; caps 40 nodes / depth 6 declared; ↻ = already shown

main gw sys_write f32_of sys_mmap sys_write ↻ gn det_fill f32_div f32_of ↻ fwd f32_add f32_mul f32_le f32_sub f32_neg f32_of ↻ f32_exp f32_div ↻ f32_of ↻ f32_mul ↻ f32_le ↻ f32_int f32_add ↻ f32_sub ↻ f32_sub ↻ f32_div ↻ f32_neg ↻ f32_log f32_div ↻ f32_sub ↻ f32_of ↻ f32_add ↻ f32_mul ↻ argmax f32_le ↻ f32_div ↻ f32_mul ↻ bwd sys_mmap ↻

structs

none

consts

22const V_MAX: i64 = 40 // vocab cap (distinct chars); real V computed from the corpus
23const D: i64 = 12 // embedding dim
24const K: i64 = 4 // context length (previous chars)
25const H: i64 = 48 // hidden width
26const KD: i64 = 48 // K*D (context vector width) -- keep in sync with K*D
27const EPOCHS: i64 = 400
28const GENLEN: i64 = 44

functions

30func grow(name: *u8, ok: i64) -> i64 { if ok==1 { gw(" PASS " as *u8) } else { gw(" FAIL " as *u8) } gw(name); gw("
calls 1: gw
32func gm(x: i64) -> i64 { return gn(f32_int(f32_mul(x, f32_of(1000)))) }
35func f32_le(x: i64, y: i64) -> i64 { let d: i64=f32_sub(x,y) & 0xFFFFFFFF; if ((d>>31)&1)==1 { return 1 } if (d & 0x7FFFFFFF)==0 { return 1 } return 0 }
called by 1: main
36func f32_abs(x: i64) -> i64 { return x & 0x7FFFFFFF }
called by 1: main calls 3: f32_off32_divf32_add
37func f32_sqrt(x: i64) -> i64 { if (x & 0x7FFFFFFF)==0 { return f32_of(0) } var y: i64=x; var i: i64=0; while i<16 { y=f32_div(f32_add(y, f32_div(x,y)), f32_of(2)); i=i+1 } return y }
38func f32_exp(x: i64) -> i64
45func f32_log(x: i64) -> i64 { let b: i64=x & 0xFFFFFFFF; let e: i64=((b>>23)&0xFF)-127; let m: i64=(b & 0x7FFFFF)|0x3F800000; let u: i64=f32_div(f32_sub(m,f32_of(1)),f32_add(m,f32_of(1))); let u2: i64=f32_mul(u,u); var t: i64=u; var s: i64=u; var k: i64=1; while k<=7 { t=f32_mul(t,u2); s=f32_add(s,f32_div(t,f32_of((2*k)+1))); k=k+1 } let ln2: i64=f32_div(f32_of(693147),f32_of(1000000)); return f32_add(f32_mul(f32_of(e),ln2),f32_mul(f32_of(2),s)) }
48func fwd(M: *i64, ctx: *i64, tgt: i64, S: *i64, vv: i64) -> i64
63func loss_only(M: *i64, ctx: *i64, tgt: i64, S: *i64, vv: i64) -> i64 { return fwd(M, ctx, tgt, S, vv) }
66func bwd(M: *i64, ctx: *i64, tgt: i64, S: *i64, G: *i64, vv: i64) -> i64
87func det_fill(dst: *i64, n: i64, m: i64) -> i64 { var i: i64=0; while i<n { let s: i64=(((i*2654435761)+m) % 17) - 8; dst[i]=f32_div(f32_of(s), f32_of(80)); i=i+1 } return 0 }
90func argmax(p: *i64, vv: i64) -> i64 { var bi: i64=0; var o: i64=1; while o<vv { if f32_le(p[bi],p[o])==1 { bi=o } o=o+1 } return bi }
93func wr_f32(fd: i64, v: i64) -> i64 { let b: *u8=sys_mmap(8); b[0]=(v & 0xff) as u8; b[1]=((v>>8)&0xff) as u8; b[2]=((v>>16)&0xff) as u8; b[3]=((v>>24)&0xff) as u8; sys_write(fd, b, 4); return 0 }
95func save_model(path: *u8, M: *i64, vv: i64) -> i64
106func load_model(buf: *u8, M: *i64, vv: i64) -> i64
118func generate(M: *i64, seed: *i64, S: *i64, vv: i64, out: *i64, n: i64) -> i64
132func main() -> i64